200 tokens/s! GLM-5.3-FlashX 硬刚 DeepSeek,轻量模型卷速度 | 9月18日 AI日报
💡 今日趋势:智谱推出 GLM-5.3-FlashX,推理速度最高达每秒 200 tokens,支持 1M 上下文,定价降至前代 2.5 倍比例换来约 5 倍提速,DeepSeek V4.1 Flash 八天前刚完成用户迁移,智谱随即正面对位,轻量模型竞争正式进入卷速度与性价比的深水区。
🤖 AI动态
1. 智谱推出 GLM-5.3-FlashX:最高 200 tokens/s,轻量模型竞争升维