一口气看完2026上半年AI变局:国产模型集体崛起
12345678955588
2026年08月06日 14:50

一句话总结

2026上半年是国产模型集体崛起的半年:从1月 Kimi K2.5 首次带来多模态,到6月 DeepSeek V4 杀入、GLM-5.2 登顶开源编程榜——国产模型在价格和编程能力上开始真正"顶"住国外,形成了"国外强在顶尖、国内强在性价比"的新格局。

逐月回顾(1-6月重点模型)

1月:国产多模态破冰

• Kimi K2.5:国产第一个多模态(+图像)模型,开源社区爆火

• 被 Cursor 未经允许拿去当内置模型,引发争议

2月:密集发布

• MiniMax-M2.7(22日):超快小模型,国内最快云服务,可本地跑

• Qwen3-Max(25日):全场景能力跃升,被认为"第一代有点恐怖"的模型

• 智谱 GLM-4.6(21日):国产编程突破,从"不能用"到"能开始编"

• 豆包 2.0(14日):宣传很猛但实测开发能力一般

• Qwen 3.5(26日):表现中规中矩,位置尴尬

3月:小米入场 + Claude 争议

• MiniMax-M2.7 和 M2.8:能力/价格平衡点,Token Plan 量大,适合接 Hermes/OpenClaw 跑复杂 Agent 任务

• Kimi K2.5 被特朗普团队当作自己的模型(后来发酵才承认)

• Claude 问题爆发:短上下文注入、缓存攻击、token 消耗快

4月:国产编程里程碑

• GLM-5.1(18日):SWE-bench Pro 开源第一!解决 GLM-4.6 的思维循环问题,任务执行稳定

• GPT-4.7(16日):中文能力下降、换 Tokenizer 变相涨价 35%(口碑崩)

• Kimi K2.6(20日):国产最强画图,但编程被 GLM-5.1 拉开

• GPT-5.5(23日):价格再涨但能力最强,至今仍是顶级

• DeepSeek V4(24日)首次登场:100万上下文,价格极低

5月:价格战

• Kimi K2.7:多模态 + 百万上下文

• Gemini 3.5 Flash / 3.7 Max:刷榜但超贵(日本市场定价)

• V4 Pro 突然打折(5月20日):DeepSeek 开始价格战

• MiniMax-M2.5 Pro 降价 99.5%:买 400-600 元就能用一个月

6月:格局定型

• MiniMax-M3(1日):顶掉小米生态位,多模态+百万上下文,前端能力极强

• Claude Opus 4.6(9日):4.7/4.8 失败后终于恢复 4.6 水准

• Kimi K2.7 Code / GLM-5.2 Code:国外模型被抢后补空缺

• GLM-5.2 Code:编程能力再上一台阶,可媲美 Claude Opus 4.5(推理时间较长,用时间换准确率)

各模型厂商点评(UP主团队实测)

🤖 Anthropic Claude(最强编程)

• 100万上下文,思维深度最深,代码稳健

• 缺点:中文表达差、不想承认自己不知道(会编)、贵、大陆限制严格

• 4.7/4.8 两代中文倒退,大量用户留在 4.6

🧠 OpenAI

• 100万上下文,视觉/视频全球最高

• GPT-5.5 至今顶级,但价格贵、不稳定

🌐 Google Gemini

• 百万上下文 + 多模态(看视频/读音频)+ 前端设计强

• 缺点:幻觉率高、世界知识下降(用户反馈)

🐬 DeepSeek(性价比之王)

• 100万上下文,全模型开源,缓存命中率高(13%)

• 编程能力与头部有差距,但价格只有 GPT 的 1/126

• V4 Pro 2.5折,V4 Flash 最便宜

🦄 智谱 GLM(国产开源编程最强)

• GLM-5.1 起 SWE-bench Pro 开源第一,5.2 更强

• 缺点:无多模态、Coding Plan 涨价(最高档 4000+元)

🍚 Kimi

• 多模态 + MCP 工具调用强(搜索能力优秀)

• 缺点:token 机废消耗快、无百万上下文

🎨 MiniMax

• M3 之后能力落地,原生多模态 + 百万上下文 + 前端不错

• Token Plan 改进后获得好评

📦 其他

• 千问:开源小模型不错(3.6 系列推荐),大模型贵且没人用

• 豆包:聊天/语音好,开发幻觉率高,即将收费

关键趋势

1. 价格差距巨大:API 调用国外最贵 vs 国内最便宜差 642 倍(同一任务)

2. 订阅 vs API:轻易开发就要上百万 token,推荐订阅制

• 国外:月费 100-800 元(中等档)

• 国内:100-200 元基本档就够(GLM/Kimi/MiniMax)

3. 变相涨价成风:Claude 换 Tokenizer、GLM 涨 Coding Plan、MiniMax 藏 Token——厂商都在收紧

4. token 消耗量暴增:现在人均单任务超 1.5M token

5. 国产崛起不可逆:开源模型(DeepSeek/GLM/Qwen)持续领先调用量

购买/使用建议(UP主总结)

聊天/日常

• Kimi K2.7:聊天最佳(中文好、会整理、接插件方便)

• 豆包:语音聊天(免费期)

• 千问 App:查地图/机票(接生态)

• Gemini:世界知识最好(喜欢猎奇/历史推荐)

成本敏感开发

• DeepSeek V4 Flash:百万上下文 + 高缓存命中,压成本首选

• GLM/MiniMax 订阅:个人开发者量够用

• 国外想省钱:Claude Code 订阅

预算充足追求效果

• Claude Opus 4.8 / 4.7 + Claude Code:最佳组合

• 或 GLM-5.2 + 视觉 MCP 配 Claude Code:开源方案