听说 Claude Opus 4.8 蒸馏了 Qwen 和 DeepSeek ,到底是蒸馏还是防蒸馏有没有懂的?| 浪浪妈雷达图
DeepSeek V4对比Qwen3.6 27B:Qwen3.6赢麻了?
能在本地部署的大模型 Qwen 3.6 27B 的性能已经接近 DeepSeek V4 Flash 了 | 小浪浪妈雷达图
看到 GPT 5.6 Sol 雷达图的那一刻,UP本人被吓到眩晕瘫坐,就像看到了原子弹爆炸 | 浪浪妈雷达图
Deepseek充10元大概能用多久
Kimi K2.6 代码能力已经可以和GPT 5.4 掰掰手腕了吗? | 浪浪妈雷达图
deepseek网页版和API版差距巨大!
不把 Fable 5 放进来的话,GLM 5.2 的代码编程和工具调用能力还是挺够看的 | 浪浪妈雷达图
Gemini 3.5 Flash 正式发布,Agent 能力直接从路边飞到T0了?输出速度也快的有点吓人,但价格嘛也直追 3.1 Pro 了 | 浪浪妈雷达图
进来看谷歌如何跌落Gemini2.5的神坛,一年内市场份额占比可视化 | OpenRouter
月耗万刀实测 | 2026年6月|16款旗舰AI模型||多维度测评
锐评2026主流AI大模型,从夯到拉依次排名!
DeepSeek V4 Pro 确实表现很不错,算是性价比之王了。能力上还有两个小的欠缺,我们会通过我们自己的中间层来补齐,预计也是需要 1-2 天。
猜猜引入防作弊基准 LiveBench 到雷达图中,会出现模型大翻车吗?| 预览版浪浪妈雷达图
DeepSeek V4 Flash vs V4 Pro 全面对比:编程能力实测分析 |全面测试 DeepSeek V4 Flash 与 Pro:编程表现差异解析
Claude Opus 4.6 仍是体感之王|浪浪妈雷达图
DeepSeek V4 编码能力开源第一!claude code测试DeepSeek+GPT+Claude+Kimi 真实游戏编码对比,最快6分钟 最慢直接失败
为何 Anthropic 如此反华?
已经默认不带Gemini玩了......——第二期代码智能体数据排名!
DeepSeek V4 Pro Claude Code 用时25分钟前端作品-测试