DeepSeek V4 真有吹的那么强?我把它塞进雷达图后沉默了 | 浪浪妈雷达图

42.3万
408
2026-04-25 01:55:09
7866
336
2930
722
关注图标喵,关注图标谢谢喵~
浪浪妈雷达图
(4/29)
319.4万播放
简介
Claude Opus 4.6 仍是体感之王|浪浪妈雷达图
01:46
Claude Opus 4.7 幻觉明显下降,代码继续扩大领先优势 | 浪浪妈雷达图
01:46
Kimi K2.6 代码能力已经可以和GPT 5.4 掰掰手腕了吗? | 浪浪妈雷达图
03:06
DeepSeek V4 真有吹的那么强?我把它塞进雷达图后沉默了 | 浪浪妈雷达图
03:12
MiMo V2.5 Pro 相比上代提升巨大,与DeepSeek V4 Pro 相比实际体验如何? | 浪浪妈雷达图
03:44
Qwen3.6 Max Preview 表现只能说中规中矩,阿里还得使劲砸钱啊 | 浪浪妈雷达图
03:44
马斯克到底在干嘛?Grok 4.3 被调成啥了都,体感相比前代迎来巨大退步 | 浪浪妈雷达图
03:50
Google 新模型发布在即,先来看看它的主要竞争对手 GPT 5.5 的表现 | 浪浪妈雷达图
03:57
Gemini 3.5 Flash 正式发布,Agent 能力直接从路边飞到T0了?输出速度也快的有点吓人,但价格嘛也直追 3.1 Pro 了 | 浪浪妈雷达图
03:57
Qwen 3.7 Max 稳步迭代,坐稳国模第一梯队,但好像没什么突出的地方 | 浪浪妈雷达图
03:57
好消息:MiniMax 发新模了,坏消息:出场还是 MiniMax | 浪浪妈雷达图
03:46
听说 Claude Opus 4.8 蒸馏了 Qwen 和 DeepSeek ,到底是蒸馏还是反蒸馏有没有懂的?| 浪浪妈雷达图
03:52
猜猜引入防作弊基准 LiveBench 到雷达图中,会出现模型大翻车吗? | 预览版浪浪妈雷达图
03:54
Claude Fable 5 成为雷达图中第一个准六边形战士,不过其回退机制好像有点过于敏感 | 浪浪妈雷达图
03:58
GLM 5.2 的上下文窗口终于被提升到了主流的1百万token | 浪浪妈雷达图
03:28
Claude Sonnet 5 对比 Opus 系列看起来挺有性价比,但也只是看起来 | 浪浪妈雷达图
03:23
马斯克花重金买来的 Cursor 外挂,帮助 Grok 4.5 取得巨大进步 | 浪浪妈雷达图
03:15
Muse Spark 1.1 的对话体感一如既往的好,但各种基准测试的跑分却没那么高,这反差真是耐人寻味啊 | 浪浪妈雷达图
03:21
看到 GPT 5.6 Sol 雷达图的那一刻,UP本人被吓到眩晕瘫坐,就像看到了原子弹爆炸 | 浪浪妈雷达图
03:23
原来月之暗面之前发布的 K2.7 Code 是装唐阴他一手,Kimi K3 才是大招啊|浪浪妈雷达图
03:38
Gemini 3.6 Flash 迭代两个月仍在原地踏步,Google 在大模型竞赛中已经明显落入下风,到底哪里出了问题?| 浪浪妈雷达图
03:38
Claude Opus 5 被指性格问题,过于神经质和自我怀疑,UP本人号被封了,有用过的说说真实体验 | 浪浪妈雷达图
03:39
OpenAI 大幅下调 GPT 5.6 Luna 价格,降幅达80%,反观 GLM Coding Plan 还在涨价 | 浪浪妈雷达图
03:44
Qwen 3.8 Max 的相对排位雷达图居然正好是一个对称图形 | 浪浪妈雷达图
03:40
想体验被顷刻炼化的可以来试试比 DeepSeek 还便宜的 Muse Spark 1.2 Contributor | 浪浪妈雷达图
03:35
Grok 4.6 雷达图首发;DeepSeek V4 Pro 正式版雷达图即将出炉 | 浪浪妈雷达图
03:38
Gemini 3.7 Flash 发布,其综合价格略低于 DeepSeek V4 Pro 正式版;Qwen 3.8 Max 现已开源 | 浪浪妈雷达图
03:40
英雄所见略同,雷达图也能略同?GLM 5.3 / Qwen 3.8 Max / DeepSeek V4 Pro 正式版 | 浪浪妈雷达图
03:43
智谱这波营销你就学吧!牛来神秘模型 Ox Alpha 真身竟是 GLM 5.3 Flash | 浪浪妈雷达图
03:54
客服
顶部
赛事库 课堂 2021拜年纪