OpenAI推出高性价比模型GPT-6.1 Sol直接对标竞品
智新纪
2026年10月02日 15:28
图片

一、OpenAI 发布 GPT-6.1 Sol 模型,价格仅为旗舰五分之一

OpenAI 今日正式推出 GPT-6.1 Sol,定位在 GPT-6 Astra 与 GPT-6 Luna 之间的中间层模型,主打编程、文档分析、电脑操作和多步骤业务工作流。

API 定价方面,GPT-6.1 Sol 标准输入为每百万 Token 2美元,输出为10美元,缓存输入低至0.1美元,仅为 GPT-6 Astra 标准输入输出价格的五分之一,缓存价格更是比 Astra 低95%。

在 DeepSWE v1.1 软件工程基准上,GPT-6.1 Sol 已能匹配 GPT-6 Astra,但单任务成本约为后者的五分之一。在 OSWorld 2.0 电脑操作测试中,该模型比 GPT-6 Sol 高出7个百分点,距离 Astra 仅差2.1个百分点。GPT-6.1 Sol 已在 ChatGPT Work、Codex 以及 API 中面向 Plus、Pro、Business、Enterprise 和 Edu 用户开放。

据 Codex 产品经理 Tibo 透露,GPT-6.1 Sol 上线后迅速成为 OpenAI 需求量最大的模型,API 和订阅服务一度承压。公司已部署额外算力,预计运行速度将在数小时内提升至前一天的近两倍。

图片

二、Claude Code 开放 Mods,支持 TypeScript 定制行为与界面

Anthropic 今日为 Claude Code 引入 Mods 功能,允许开发者用少量 TypeScript 代码改变工具的行为和界面。

Mods 本质是钩入 Claude Code 事件的小型函数。每次工具调用、权限请求或界面绘制都会触发事件,Mods 可在事件之前、之后或替代事件执行。通过一个函数,Mods 即可重写提示词、阻止或重试工具调用、审批权限请求,甚至直接在工具输出送达 Claude 之前脱敏敏感信息。

界面层面,Mods 可以编辑或替换 Claude Code 绘制的界面元素,添加按钮和输入框,终端和桌面应用均支持。多个 Mods 钩住同一事件时按加载顺序执行,方便叠加来自不同作者的修改。

Anthropic 表示,部分内置功能已改为以 Mods 形式发布,例如 `/diff` 功能现在就是一个可关闭或替换的 Mod。企业版中,内置的 `sec-default` Mod 会首先加载,阻止用户安装的 Mod 执行覆盖权限拒绝规则等高风险操作。

图片

三、Earendil 发布 Pi 1.0 正式版与 Pi Durable 实验框架

开源 AI 代理框架 Pi 的开发方 Earendil 今日发布 Pi 1.0 正式版,同时推出实验性框架 Pi Durable,用于构建可长时间运行的 AI 代理。

Pi Durable 的核心能力是断点恢复:任务状态持续写入存储,进程崩溃、容器重启或电脑休眠后仍可读取先前保存的进度继续执行。它将模型调用和工具调用拆解为可恢复任务并保存检查点,模型请求中断后可重新发起,工具仅在确认可安全重跑时自动重新执行。

除故障恢复外,Pi Durable 还支持多条对话同时运行、保存排队消息和子代理状态、自动压缩过长上下文,并允许多个客户端连接同一代理查看进度或继续下达指令。Pi 1.0 的主要更新包括默认全屏 TUI、代码模式精简约40%提示词 Token、新增图像生成能力,以及 Anthropic 登录支持复制代码方式。

四、GitHub 推出 gh-secure,一键加固公开仓库

GitHub Security Lab 发布 gh-secure 工具,开发者可通过一条命令为代码仓库开展基础安全防护,减少机密信息泄露到公开代码中的风险。

该工具支持在 Copilot 应用、Copilot CLI 和 GitHub CLI 中安装使用,覆盖应用与命令行场景。官方强调其定位是降低仓库安全维护门槛,让日常防泄露操作更简便。不过现有信息未列出具体支持识别的机密类型或检测范围,因此不能理解为能够消除所有泄露问题。

图片

五、Stitch by Google 推出 CLI 命令行工具

谷歌正式发布 Stitch CLI,将编码智能体、UI 生成和设计系统同步能力整合到终端中,支持 Node.js 20 及以上版本,可通过 `npm install -g @google/stitch` 安装。

该工具可连接本地编码智能体、根据提示词生成界面页面、搭建设计系统,并能抓取本地开发服务器页面快照上传至 Stitch 平台。开发者可为 Claude Code、Cursor、Gemini CLI、Antigravity 等编码智能体添加 `/stitch` 技能,直接在对话中调用。

Stitch CLI 还开放了 `stitch loop` 命令,启动后智能体可7×24小时监控代码库、日志、埋点分析与用户反馈,自动挖掘问题并输出优化方案。命令均支持 `--json` 结构化输出和 `--schema` 模式,方便智能体无需阅读文档即可发现 API。

六、Black Forest Labs 正式发布 FLUX 3 Image 图像模型

Black Forest Labs 发布 FLUX 3 Image 图像生成模型,支持最高4K分辨率生成,核心特色是可通过边界框(bounding box)精确指定画面中各元素的位置。

该模型支持最多10张参考图输入,用户可描述如何利用参考图——编辑细节、改变风格或合成新构图。图像编辑功能可在修改目标区域的同时,在像素层面保持其他区域不变。FLUX 3 Image 已通过 API 提供服务,定价根据生成参数灵活调整,官方表示开源模型版本将在数周内发布。

图片

七、微软 AI 发布三款 MAI 语音模型

微软 AI 今日在 Vercel AI Gateway 上线三款语音模型,覆盖语音生成和实时转录场景。

MAI-Voice-2.1 支持23种语言的高表现力语音生成,可在长段内容中保持说话人一致性,适合有声书、播客和课程旁白。MAI-Voice-2.1-Flash 提供相同多语言能力但延迟更低,适合语音代理和实时助理。MAI-Transcribe-2 Streaming 则在音频流仍在传输时返回部分转录结果,可用于实时字幕或对话跟随。AI Gateway 按模型标价计费,不收取平台费或推理加价。

图片

八、Cloudflare 发布并开源 Clef 与 Clef-flash 决策模型

Cloudflare 推出开源多模态决策模型 Clef 和 Clef-flash,基于 Qwen 基座模型(Clef 基于 Qwen3.8-27B,Flash 基于 Qwen3.5-9B)。

与仅支持文本分类的 Jev 不同,Clef 原生配备视觉编码器,可直接解析图像输入并进行视觉内容判别,上下文窗口也从 Jev 的32K扩展至64K。

两款模型完全兼容 Jev-API,开发者只需更改 API 地址即可切换。在延迟方面,Clef-flash 中位延迟仅38.8毫秒,p95延迟122.4毫秒,适合放在智能体热路径中快速做决策。Cloudflare 同时发布了强化学习微调平台,客户可针对特定业务场景对 Clef 进行定制化训练。

图片
图片