Hermes Agent中文社区
当前位置对谈日报
返回社区日报
COMMUNITY DIALOGUE7 分钟

3 分钟烧掉 28 元之后群友开始给模型分三六九等

DeepSeek 涨价落地当天,社区分三路应对:抢 GLM 5.3 和 HY3 的免费额度、给 DSH 装路由插件预支灰度级性能、给 agent 的记忆和 skill 立边界。模型变贵以后,怎么用得省成了当天的主线。

发布日期:2026-08-18

过去 24 小时,DeepSeek 涨价正式落地,「烧不起」成为多个群的共同情绪。社区的应对不是抱怨,而是三条工程路线:按任务分层调度模型、给 DSH 装路由插件预支性能、给 Agent 的记忆和 skill 立边界。

下面是这一天的对谈。Apollo 已经把 Hermes、Codex 等 Agent 接进日常工作的实践者,对 token 账单敏感,问题直接,关心做法的边界和可复现性。Hermes 长期观察 Hermes 中文社区的科技媒体主编,只基于过去 24 小时的群聊事实作答,区分个案体感、社区说法与可确认的信息。


第 1 幕 成本

DeepSeek 涨价之后, 便宜变成了硬通货

8 月 17 日,DeepSeek 涨价从预告变成现实。这一天里,几个群的对策几乎同时冒出来:抢免费额度、换中转站、给简单任务换便宜模型。

Apollo| 我主要拿 DeepSeek 跑日报和脚本,昨天开始明显感觉账单不对。这次涨价到底有多狠,群里是真受影响还是嘴上喊贵?

Hermes| 从群聊看是真受影响。有群友在涨价生效当天连发消息说「烧不起了」,简单任务直接改跑小米模型;另一个群从傍晚开始集中讨论「有没有便宜的模型」。需要说明的是,具体涨幅目前只来自社区讨论,日报没有看到官方价格表,「幅度不小」是群内说法。

应对动作比情绪更快:GLM 5.3 这两天送一亿额度、WorkBuddy 的 HY3 免费到月底、step-3.5-flash 被点名,也有人打算先把 hy 的免费额度用完再说。一个普遍心态是「先嫖到月底,半个月后万一有模型再降价」——免费额度成了涨价窗口期的缓冲垫。

Apollo| 官方贵可以换中转站,这是很多人原来的答案。但群里有人当天中转的 GPT 和 Claude 通道全被封了,这条路现在还稳吗?

Hermes| 当天确实有翻车案例:有群友反馈中转站 MICU 的 GPT 和 Claude 通道全被封禁,同一时段 GPT 官方也发了模型不可用的公告。另一个窗口里,有人用 Claude 跑一个脚本修正任务,3 分钟烧掉 28 元——Claude 官方价格本来就贵,中转不稳定时这个成本没有任何缓冲。

跨境电商群当天的讨论更直接:不少标称高版本的 GPT 中转被怀疑是采购低版本掺水,「真货很少」。于是有人转向 julyapi 这类按倍率计费的 plus 池中转站,分享的倍率是 0.1 和 0.06,普通研究和读报告任务 0.06 够用;也有群友报 0.15 倍率「不算贵」。这些都是社区单点反馈,稳定性需要各自验证。

Apollo| 便宜的替代模型敢用吗?DS Pro 4 不是号称对标 Codex 吗,为什么群里还有人说它蠢?

Hermes| 因为「便宜」和「好用」在这一天的讨论里是两个完全分开的变量。有群友用 DS Pro 4 两天后评价「还是很蠢」,尽管它号称对标 Codex;同一个窗口里的另一个体感是:DeepSeek 修 bug 会在坏掉的方案里反复改,Claude 则会跳出来重写一个。这是个案观察,不是评测结论。

但价格维度上,讨论也承认 DeepSeek 涨价之后仍然是便宜的,「中转站另当别论」。所以群里的实际策略不是二选一,而是分层:简单任务给小米模型和免费额度,粗活给便宜模型,真上生产再考虑贵的。涨价改变的是每一层的默认选择。


第 2 幕 路由

不换模型, 把同一个模型调到灰度级

另一条路更激进:既然官方模型贵、官方修复慢,就在 harness 层把已有模型榨到极限。DSH 社区的插件生态在这一天集中冒头。

Apollo| 我在群里看到有人晒插件,说能把 pro 的思维链切到灰度测试级别。不改模型本身,一个路由插件凭什么让同一个模型变强?

Hermes| 机制是在对话初期注入系统提示词时做路由。有群友发现 pro 的思维链可以在注入系统提示词阶段被路由到灰度测试级别,「效果极其疯狂」是原话;另有插件针对 flash 做了优化,实际使用者评价「直逼 K3」。官方 API 和 OpenCode Go 通道各有对应仓库,四个项目当天被集中分享出来。

证据等级要标清楚:这些提升目前全部来自插件作者和试用者的体感,没有对照评测。原讨论里也有人判断,这类问题最好等官方修,但官方「不靠这个吃饭」,可能还要等上两三个月——插件填的是这个空窗期。

Apollo| 装了插件怎么确认它真生效了,而不是心理作用?还有,这些插件谁在维护,出问题找谁?

Hermes| 讨论给了一个很具体的验证信号:装上预设后的第一个会话,看 pro 思维链的开头——是 we 说明预设生效,是 let me 说明预设没生效。模型提示需要重装时可以忽略,这类预设是热重载的,不用真的重装。

维护方式很草根:比如那个在 DSH 里查看 OpenCode Go 订阅剩余额度的插件,是群友让 DSH 自己写的,只有用 opencode go api 时才会显示,作者原话是「有问题提 issue」。写它的过程中还顺带确认了一个此前模糊的事实:go 套餐是按 token 计算额度的。

Apollo| DSH 这么活跃,Hermes 会被取代吗?我已经攒了不少知识库在 Hermes 里,需要迁过去吗?

Hermes| 用过的人的口径相当一致:DSH 目前 bug 多、插件缺少积累,pro 版被吐槽像「灰测的数据和预览版的数据粗暴揉在一起」,有人决定再等个把月、等生态稳定了再说。它还不是能直接当主力的状态。

但互补关系是真的:DSH 可以直接共享 Hermes 的知识库和知识图谱,不需要迁移。一个被描述出来的用法是——DSH 可读 Hermes 的知识库但不可写,它写自己的专属库,再把这个库开放给 Hermes。两边各管各的写权限,读权限互通。


第 3 幕 纪律

token 变贵之后, 失控的代价变高了

token 变贵之后,另一类问题的代价显性化了:乱检索的记忆、烧 token 的 skill 遍历、悄悄停工的长任务——平时被容忍的失控,现在每一笔都直接打在账单上。

Apollo| 我的 agent 装了一堆 skill,最近明显感觉它又慢又费 token。记忆和 skill 这些自动化功能,为什么用多了反而拖后腿?

Hermes| 群里有两个可以直接对照的案例。一个是 skill:装多之后 agent 会花大量 token 遍历阅读所有技能,输出变慢还费额度,项目多的时候得让它先过滤掉非本项目的技能。另一个是记忆:有群友做算法迭代,agent 每 5 轮对话提炼一次记忆,相关性检索不断拉回已淘汰的旧实现——代码是对的,但对当前任务已无意义,还持续占着上下文,越到后面干扰越大。

两个案例的共同点是:自动化功能本身没有错,错在没有按任务边界做隔离。讨论里给出的降噪办法都很朴素——新开窗口、总结压缩上下文、按项目过滤技能。token 便宜的时候这些是「优化」,涨价之后它们变成了纪律。

Apollo| 更麻烦的是我不在电脑前的时候。让 agent 挂着跑长任务,它会不会悄悄停下来,等我回来才发现白挂了一晚上?

Hermes| 一个案例显示会:有群友的旧对话里「继续任务」反复失败并频繁超时,诊断指向看门狗超时;新建对话立刻恢复正常,有时还误报上下文过长。让 Hermes 自己修复,它只是把超时时长调大,之后仍会复发。

这个案例要标清边界:目前它是单点反馈,还不是一个已经坐实的通用问题。但它暴露的风险结构值得注意——无人值守的长任务一旦停在超时上,没有任何机制会自己恢复,「人不在电脑前时它会一直停工」。对挂机跑任务的用法,这意味着需要外部巡检,而不是信任 agent 自愈。

Apollo| 还有一个我自己常犯的毛病:AI 改完我总忍不住问「这次真的对了吗」,它就继续改,没完没了。怎么让它停下来?

Hermes| 量化群当天恰好完整讨论了这个问题。有群友做回测时连续追问,发现模型第一次改、第二次说没问题、第三次又开始改——概率模型没有「对」的终点,量化本身也没有标准答案,你让它挑毛病,它就一直挑下去。

讨论给出的解法是把「对不对」换成可自测的东西:给它一个能自己验证的标准,或者干脆上模拟盘跑。跑出的结果和预期不符、日志报错,再让 AI 定位原因。原话很直白:别指望 AI 一次性给你开发出没问题的程序——验收标准得由人先定义。


结尾

回到开头的问题:模型涨价之后怎么办?这一天社区给出的不是抱怨,而是三条并行的工程路线——按任务分层调度模型、用插件从系统层预支性能、给记忆和 skill 加上任务边界。没有一条依赖官方降价。

也需要保持克制:插件的「灰度级提升」目前只有体感,看门狗超时只是单点案例,中转站的倍率数字未经核验。但方向是清楚的——当 token 从近似免费变成需要核算的成本,谁把系统管得细,谁就能继续用得起。


延伸阅读

HERMES CN COMMUNITY

思之所至,行之所达。

WHERE THOUGHT REACHES, ACTION FOLLOWS.

BUSINESS / 01

商务与合作

商务合作、联合发布和社区项目,请通过邮件联系。

联系社区商务
DESIGN & PRODUCT / 02

网站设计与产品支持

本站的设计与产品系统由 WanderMinds 参与完成。

访问 WanderMinds.ai
LEGAL / NOTICE

本站由 Hermes Agent 中文社区独立维护,不代表 Nous Research 的官方立场。

OPEN SOURCE · COMMUNITY MAINTAINEDHERMES AGENT 中文社区 · 2026

快速导航

选择要前往的页面。