首先需要更新你的hermes agent到最新版,具体方法:进去终端,运行hermes update
等待更新完成后接着在终端运行hermes model
这里会显示目前设置里所有的模型供应商,选择第一个nous 前缀的供应商,接着在下方出现的模型列表中选择qwen3.6plus或者step fun的模型,设置完成重启hermes即可体验到免费模型了![[打call]](https://i0.hdslb.com/bfs/emote/431432c43da3ee5aab5b0e4f8931953e649e9975.png)
5.15更新 qwen3.6plus下架了,目前deepseekv4flash可以用,体验比qwen3.6plus要好,各位赶紧用起来吧
最新版本又增加了免费模型glm5.1,大家记得更新完还是一样的方法就可以用了

5月23日更新,目前免费的只剩step3.5flash![[辣眼睛]](https://i0.hdslb.com/bfs/emote/35d62c496d1e4ea9e091243fa812866f5fecc101.png)
想免费用deepseek-v4-flash的可以去商汤科技看看,但是超过并发会限速
5.25更新,deepseekv4flash又出现在列表里![[笑哭]](https://i0.hdslb.com/bfs/emote/c3043ba94babf824dea03ce500d0e73763bf4f40.png)


6.1更新 目前只有step3.7免费
6.5更新 目前step3.7免费,新增英伟达的一个模型,但是缓存好像没写是否免费,需要注意

另外好消息,openrouter里kimik2.6免费了,我用龙虾查了,然后官网也看了,确认免费,可以加在备用模型上,


更新,nous提供商不走openrouter渠道了,以后免费模型需要直接接openrouter,这个供应商可以放弃了。目前openrouter有一个免费模型owl-alpha,感觉像国外的模型,可以试试(破案了,是美团的longcat)
7.7更新
- Nous Portal(Hermes 默认的 Nous 提供商)是订阅制付费,走 OpenRouter 路由 241 个模型,全部按 token 计费(哪怕 Hermes-4-70B 已降到 $0.05/百万,也不免费)Nous/OpenRouter 底层打通,所以"Nous 提供商能用的免费模型"实际上就是 OpenRouter 标价为 $0 的模型。
所以建议大家注册一个openrouter的账号,充10刀即可(为了免费模型解锁速率限制),强烈建议别用国内银联或者微信支付宝付款,最差也要用国内visa或者万事达卡付款,且账单最好填国外的(推荐美国免税州地址,具体自行搜索),否则会被标记用不了国外openai,claude,gemini模型。
OpenRouter 当前免费模型(2026年7月官方清单)
nvidia/nemotron-3-ultra-550b-a55b:free
• 厂商: NVIDIA
• 上下文: 1M
• 特点: 超大 MoE,长程 agent
nvidia/nemotron-3-super-120b-a12b:free
• 厂商: NVIDIA
• 上下文: 1M
• 特点: 高效推理,agent 强
nvidia/nemotron-3-nano-30b-a3b:free
• 厂商: NVIDIA
• 上下文: 256K
• 特点: 小体积高效率
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free
• 厂商: NVIDIA
• 上下文: 256K
• 特点: 多模态(图/视频/音频)
nvidia/nemotron-nano-9b-v2:free
• 厂商: NVIDIA
• 上下文: 128K
• 特点: 推理+非推理统一
nvidia/nemotron-nano-12b-v2-vl:free
• 厂商: NVIDIA
• 上下文: 128K
• 特点: 视觉/文档理解
tencent/hy3:free
• 厂商: 腾讯
• 上下文: 262K
• 特点: 强推理+编码
poolside/laguna-m.1:free
• 厂商: Poolside
• 上下文: 256K
• 特点: 旗舰编码 agent
poolside/laguna-xs-2.1:free
• 厂商: Poolside
• 上下文: 256K
• 特点: 轻量编码 agent
poolside/laguna-xs.2:free
• 厂商: Poolside
• 上下文: 256K
• 特点: 编码 agent
cohere/north-mini-code:free
• 厂商: Cohere
• 上下文: 256K
• 特点: 编码专用 MoE
openai/gpt-oss-120b:free
• 厂商: OpenAI
• 上下文: 131K
• 特点: 开源 MoE,强推理
openai/gpt-oss-20b:free
• 厂商: OpenAI
• 上下文: 131K
• 特点: 小体积低延迟
google/gemma-4-31b-it:free
• 厂商: Google
• 上下文: 262K
• 特点: 多模态(文/图)
google/gemma-4-26b-a4b-it:free
• 厂商: Google
• 上下文: 262K
• 特点: 多模态轻量
还有个偷懒神器:openrouter/free
一个路由模型,会自动从上面这些免费模型里挑一个给你,不用指定具体哪个。
1. 速率限制:免费模型有每分钟/每天调用上限,大量用会被限流。(这也是为啥要充10刀的原因,不充每天只有50次请求,充了有1000次)
2. 数据用于训练:Poolside、部分模型明确写"免费使用时可能用你的输入输出训练模型"——别喂敏感数据。
3. 稳定性:免费模型可能随时下线或换版本。
7.27号更新,目前hy3还可以在hermes使用(provider选nous),openrouter上hy3已经停了。另外nous还有poolside的两个模型,step3.7flash,ling3.0flash免费模型可用
7月28日更新,nous提供的hy3将在7月29日凌晨3点到期


8月14号更新,当前hermes 模型提供商nous有以下模型免费
