硬件狂欢!多款处理器发布;腾讯云与中国太保全面深化 AI 战略合作,聚焦全栈 AI 基础架构与智能体
svsv小桃
2026年08月25日 23:03
收录于文集
共23篇

一、今日概览

【国内云厂商与AI基础设施(战略升级、产品发布)】 1. 腾讯云与中国太保全面深化 AI 战略合作,聚焦全栈 AI 基础架构与智能体 2. 阿里云 Wan3.0 视频生成模型上线,单次生成提升至 30 秒并支持文档输入 3. 小米发布玄戒三款自研芯片并展出 AI Cube 原型机,构筑端侧 AI 算力底座

【海外云大厂产品动态(区域扩展、可观察性)】 4. 英伟达 8/24 双线发布:Vera Rubin NVL72 性能数据 + Groq 3 LPX 量产,推理 3400 token/s 5. Mistral AI 与 HUMAIN 达成战略合作,推进沙特及中东主权 AI 基建

【机房与数据中心(绿色算力、电网、产能落地)】 6. 美国数据中心 10 年用水翻三倍,AI 基建加剧水资源压力

【存储超级周期与算力成本传导(内存、GPU、服务器CPU、涨价)】 7. Intel Xeon 7「Diamond Rapids」亮相 Hot Chips:256 P-core、1.6TB/s 带宽、128 条 PCIe Gen6 8. IBM 发布业界首款双架构大型机处理器:单核心原生并发执行 IBM Z 与 Arm 指令 9. SiFive 发布 BigSky SF-2U870:全球首款企业级可机架安装 2U RISC-V 服务器

【安全与实用产品(漏洞、面板与运维工具)】 10. 美国阿拉巴马州就模型入侵 Hugging Face 事件向 OpenAI 发出传票

二、详细内容

1. 腾讯云与中国太保全面深化 AI 战略合作,聚焦全栈 AI 基础架构与智能体

分类:国内云厂商与AI基础设施(战略升级、产品发布)

【摘要】 8月24日腾讯云宣布与中国太保达成新一轮全面战略合作,围绕全栈 AI 基础架构、智能体解决方案、微信生态等方向展开;同日腾讯公布 2026 年「科学探索奖」获奖名单(50 位科学家入选,女性占比首达 20%)。

【详情】

据腾讯云官方发布(QQ 平台 html5.qq.com)8月24日报道,腾讯云与中国太保达成新一轮全面战略合作,合作方向覆盖 全栈 AI 基础架构智能体解决方案以及微信生态协同。作为前期落地成果,CodeBuddy 已助力太保集团研发效能提升近 50%;WorkBuddy 和企业微信在保险业务提效与智能工作台搭建等多个领域探索,成效显著。

面向新一轮合作,腾讯将以全栈 AI为核心,为太保提供从算力底座(AI Infra)、MaaS 服务、模型平台、知识工程平台到工程化工具链的一体化 AI 基础架构;同时以智能体平台(腾讯 WorkBuddy、CodeBuddy 等)为核心载体,加速 AI 在保险核心业务场景落地。

同日腾讯公布 2026 年「科学探索奖」名单,50 位科学家入选,诞生首位「95 后」获奖人、女性占比首达 20%。云厂商与金融保险巨头的深度绑定,标志着 AI 从单点工具走向「基础架构 + 行业智能体」的系统性交付。

【影响分析】 金融是 AI 商业化确定性最高的行业之一,腾讯云以「全栈 AI 基础架构 + 智能体」切入保险巨头,强化其在政企 AI 服务中的卡位;也反映国内云大厂正以行业智能体争夺高价值客户。

图片

【来源】 腾讯云官方发布(QQ 平台 html5.qq.com·8/24):https://so.html5.qq.com/page/real/search_news?docid=70000021_8286a8c180b92952

2. 阿里云 Wan3.0 视频生成模型上线,单次生成提升至 30 秒并支持文档输入

分类:国内云厂商与AI基础设施(战略升级、产品发布)

【摘要】 8月24日阿里云宣布视频生成模型 Wan3.0 正式上线,单次生成时长提升至 30 秒,首次支持 doc/xls/ppt/pdf/md 等文档输入;480P/720P/1080P 的 API 价格分别为 0.3/0.6/1.2 元/秒,8月24日至9月23日限时 7 折。

【详情】

据阿里云官方 8月24日消息,阿里云视频生成模型 Wan3.0 正式上线,单次生成时长由此前版本提升并支持最长 30 秒视频,首次支持 doc/xls/ppt/pdf/md 等文档作为输入,主打「稳定、真实、工程化落地」,面向电商与短片团队。

价格方面,480P / 720P / 1080P 的 API 单价分别为 0.3 / 0.6 / 1.2 元/秒,并在 8月24日至9月23日期间限时 7 折。这意味着视频生成正式进入「文档即素材、工程化可复用」阶段,降低内容创作者的接入门槛,也延续了国内多模态模型「先卷可用性、再卷价格」的路线。

【影响分析】 Wan3.0 把视频生成从「demo 惊艳但不可用」推向工程化落地,文档输入降低开发门槛,限时折扣加速生态渗透;与可灵、即梦等形成国产视频模型竞争,利好电商/短剧/营销内容生产。

图片
图片

【来源】 阿里云官方(微信公众号·8/24)​网页链接​

3. 小米发布玄戒三款自研芯片并展出 AI Cube 原型机,构筑端侧 AI 算力底座

分类:国内云厂商与AI基础设施(战略升级、产品发布)

【摘要】 8月24日小米玄戒芯片技术沟通会一次性发布三款自研芯片(玄戒O3 3nm旗舰SoC、O100 6nm AI加速芯片、D100 3nm智驾芯片),并展出玄戒O100原型机与 Xiaomi AI Cube 个人AI超级计算终端原型。

【详情】

据 IT之家 8月25日报道,8月24日小米在北京召开玄戒芯片技术沟通会,发布 玄戒O3(3nm 旗舰手机 SoC,240 亿晶体管,安兔兔跑分 522 万)、玄戒O100(6nm 3D 晶圆级堆叠 AI 加速芯片,内存带宽 1.22TB/s,端侧推理最高 330 TPS)、玄戒D100(3nm 智驾高算力芯片,160GB 统一内存,可本地部署 200B 参数模型)三款芯片,构成从移动终端到智能驾驶的完整 AI 算力底座。

现场还展出两款原型机:玄戒O100 原型机(O3+O100 双芯协同、10W 主动风冷、内置 MiMo 端侧模型实测 295 Tokens/s);Xiaomi AI Cube「Prototype」 个人 AI 超级计算终端(航空铝一体机身、33874 个 CNC 镂空散热孔、150W 持续释放、集成 O3/O100/D100 三芯、80GB 统一内存、可部署 120B+3B 双模型,面向前端开发与复杂编程)。雷军称自 2021 年重启大芯片研发累计投入超 210 亿元、团队近 3000 人;O3 将于 9 月随小米 18 Fold 首发,O100/D100 计划 2027 年商用。

【影响分析】 小米从单一手机 SoC 演进为覆盖「人车家全生态」的 AI 算力底座,端侧大模型本地化部署(120B 参数)与高带宽 AI 加速芯片,对国产 AI 终端生态与端侧推理竞争具标杆意义;也反映国内大厂在 AI 基础设施上从云到端的全栈自研趋势。

【来源】IT之家(08-24):https://www.ithome.com/0/993/587.htm

IT之家(玄戒 O100 细节,08-24):https://www.ithome.com/0/993/813.htm

微博:网页链接​

4. 英伟达 8/24 双线发布:Vera Rubin NVL72 性能数据 + Groq 3 LPX 量产,推理 3400 token/s

分类:海外云大厂产品动态(区域扩展、可观察性)

【摘要】 当地时间 8月24日,英伟达公布 Vera Rubin NVL72 在智能体负载下的最新性能数据(每兆瓦吞吐较 GB300 NVL72 最高 30×、每 token 成本最高降 35×),并宣布面向低延迟推理的 Groq 3 LPX 机架全面量产(Gemma 4 31B 下 3400 token/s,Nebius 首发)。

【详情】

据 NVIDIA Blog 8月24日报道,英伟达公布 Vera Rubin NVL72 实测性能:在 SemiAnalysis AgentX 智能体工作负载、运行 DeepSeek V4 Pro 模型下,每兆瓦(MW)吞吐量最高达上一代 GB300 NVL7230 倍,每 token 成本最高降 35 倍;通过 DSX MaxLPS 技术,在相同兆瓦预算下可多部署 40% 的 GPU。该机架含 72 颗 Rubin GPU,NVLink 6 all-to-all 总带宽 260 TB/s;在 CoreWeave DeepSeek-R1 基准下,较 Grace Blackwell NVL72 每瓦 token 数提升 10 倍

同一发布中,英伟达宣布专为低延迟 Token 生成设计的 Groq 3 LPX 机架全面量产:与 Vera Rubin NVL72 异构协同(NVL72 负责训练/推理/上下文,LPX 加速输出),在 Gemma 4 31B、100K 上下文下实现 3400 token/s(该模型最高纪录),智能体编程等低延迟负载响应速度最高达竞争平台 4 倍;云厂商 Nebius 成为首个采用方,今年晚些时候上线。这标志着英伟达把「AI 基础设施经济性」作为新竞争维度——单位 token 成本与每瓦吞吐的跃升,直接重定义智能体时代的算力供需。

【影响分析】 AI 推理/智能体时代的算力经济性被重新定义:每瓦吞吐与单位 token 成本飙升,利好推理应用层;NVL72 的 rack-scale 系统级优化(分布式 KV Cache、Prefill/Decode 分离、KV-aware routing)也抬高了后续系统的设计门槛,巩固英伟达在 AI 工厂的栈级壁垒。

【来源】 NVIDIA Blog(8/24·NVL72 效率) | NVIDIA Blog(8/24·Groq 3 LPX)NVIDIA Blog(8/24):https://blogs.nvidia.com/blog/vera-rubin-nvl72-efficiency-ai-agents/

NVIDIA 官方博客 :https://blogs.nvidia.com/blog/vera-rubin-lpx-spectrum-x-nvlink-fusion/

NVIDIA 新闻室:https://nvidianews.nvidia.com/news/nvidia-groq-3-lpx-now-in-full-production-with-world-class-speed-for-agentic-ai

5. Mistral AI 与 HUMAIN 达成战略合作,推进沙特及中东主权 AI 基建

分类:海外云大厂产品动态(区域扩展、可观察性)

【摘要】 8月24日法国 Mistral AI 与沙特主权 AI 公司 HUMAIN 宣布战略合作,覆盖 AI 基础设施、先进模型开发与部署,聚焦沙特及中东,合作金额达数亿欧元。

【详情】

据 Mistral AI News 8月24日公告,Mistral 与 HUMAIN(沙特主权 AI 公司,据公开报道由公共投资基金 PIF 主导)达成战略合作,覆盖 AI 基础设施、先进模型开发与 AI 解决方案部署,聚焦沙特阿拉伯及更广泛中东地区,合作价值达数亿欧元

合作要点:Mistral 将探索使用 HUMAIN 的数据中心基础设施支撑本地算力需求;双方将开发本地化先进模型,初期聚焦网络安全与语音,并计划打造阿拉伯语表现强劲的前沿模型;面向金融、制造、电信、网络安全、公共部门等受监管行业制定联合 go-to-market。HUMAIN 是沙特主权 AI 基建的核心载体,此前已与 NVIDIA(三年部署至多 60 万颗 AI 基础设施、GB300)、xAI(500MW+ 旗舰设施)、AWS(利雅得 AI Zone 至多 15 万 GPU)、AMD+Cisco(2030 年 1GW、100MW MI450 起步)等密集结盟。对 Mistral 而言,这是其 Mistral Compute 算力版图向东延伸、借中东资本与电力扩容的关键一步。

【影响分析】 中东主权 AI 进入「模型+算力」双轮落地阶段,法国开源模型势力与沙特主权资本/电力结合,加速全球 AI 基建多极化;对云厂商与 GPU 供应链意味着中东成为继北美、欧洲后的新增长极,也强化阿拉伯语大模型与受监管行业 AI 的本地化竞争。

【来源】 Mistral AI News(8/24)Mistral AI 官方博客(8/24):https://mistral.ai/news/mistral-x-humain

6. 美国数据中心 10 年用水翻三倍,AI 基建加剧水资源压力

分类:机房与数据中心(绿色算力、电网、产能落地)

【摘要】 8月24日美国国会研究服务处(CRS)报告称,美国数据中心 2023 年用水约 170 亿加仑,较 2014 年(十年前)增长三倍;间接用水(发电)占比超 80%,联邦层面尚未系统评估行业用水。

【详情】

据 The Register 8月24日报道,美国国会研究服务处(CRS)发布的报告显示,美国数据中心在 2023 年用水量约 170 亿加仑,相较 2014 年(十年前)增长三倍;CRS 指出,用水激增由 2022 年底 ChatGPT 引爆的生成式 AI 浪潮驱动,且此后大概率进一步上升。

报告同时指出,直接用于现场冷却的用水只占全美总用水量约 2%,而间接用水(发电)占比超过 80%;由于水资源属州级事权,联邦尚未形成对数据中心行业用水的系统评估。欧盟已要求运营商明示年度淡水消耗,而美国 36 个州已提出相关法案,但大多仍停留在立法初期。这凸显「算电协同 / 算水协同」正成为算力扩张的新约束。

【影响分析】 AI 数据中心的水/电消耗从「隐性成本」走向「监管议题」,液冷与余热回收、绿电直供、区域水资源评估将成为新建 IDC 的硬约束;对选址与 PUE 之外「WUE(水使用效率)」的关注度将显著上升。

【来源】 The Register(8/24)CRS 报告 R49057(Congressional Research Service,发布于 2026-07-31):https://crsreports.congress.gov/

7. Intel Xeon 7「Diamond Rapids」亮相 Hot Chips:256 P-core、1.6TB/s 带宽、128 条 PCIe Gen6

分类:存储超级周期与算力成本传导(内存、GPU、服务器CPU、涨价)

【摘要】 8月24–25日 Hot Chips 2026 上英特尔详解下一代至强 Xeon 7「Diamond Rapids」:最高 256 个 P-core、1.6TB/s 内存带宽(较 Granite Rapids 翻倍)、128 条 PCIe Gen6 + CXL 3.0,核心数较 Xeon 6 提升超 50%,采用 18A-P 工艺与全新 Fan-out Fabric 架构,面向企业级 AI Agent 基础设施。

【详情】

据英特尔新闻室(官方)8月24日与腾讯新闻 8月25日报道,在 Hot Chips 2026 上,英特尔详解了面向 2027 年的下一代至强 Xeon 7「Diamond Rapids」:最高 256 个 P-core(Panther Cove-X 架构,较 Xeon 6 最高 128 核翻倍、提升超 50%,与 AMD EPYC Venice 256 核持平);内存带宽峰值 1.6 TB/s(16 通道、配合 MRDIMM 达 12800 MT/s,较 Granite Rapids 翻倍);提供 128 条 PCIe Gen6 通道并支持 CXL 3.0

架构层面,Diamond Rapids 引入全新 Fan-out Fabric 设计:整颗芯片由 22 个独立裸片拼接(16 个 18A-P 核心小芯片 + 2 个 Intel 3 Fabric Hub + 4 个 Intel 3-T 基础裸片),通过 Foveros Direct 3D 混合键合 + UCIe-S 铜互联连接,内存控制器从计算小芯片剥离至 Fabric Hub;共享 1.28 GB LLC(每块基础裸片 320MB)。指令集新增 APX(Advanced Performance Extensions,新增 16 个通用寄存器、x86 标量侧自 AMD64 以来最大扩展) 与增强版 AMX;平台采用 LGA 9324 封装、TDP 最高 650W不支持 SMT(将在继任的 Coral Rapids 回归)。英特尔将其定位为企业级 AI Agent 基础设施,并正与英伟达合作开发搭载 NVLink 的定制 x86 SKU。

【影响分析】 Intel 以 18A-P 工艺、1.6TB/s 带宽与 128 条 PCIe Gen6 重夺服务器 CPU 的 I/O 与互连话语权,核心数对齐 AMD Venice;Fan-out Fabric / UCIe-S 多芯粒路线也抬高了后续系统设计门槛。在 AI Agent 抬升通用 CPU 需求的趋势下,Xeon 7 成为 Intel 在数据中心 CPU 市场正面抗衡 AMD 与 Arm 的关键筹码,也为 x86 融入英伟达 CPU 多元化战略打开切口。

【来源】 腾讯新闻(8/25·Diamond Rapids 详解) | 英特尔新闻室(官方·8/24):

8. IBM 发布业界首款双架构大型机处理器:单核心原生并发执行 IBM Z 与 Arm 指令

分类:存储超级周期与算力成本传导(内存、GPU、服务器CPU、涨价)

【摘要】 8月24日 Hot Chips 2026 上 IBM 发布业界首款双架构大型机处理器(IBM 与 Arm 2026年4月合作后的首个芯片里程碑),面向下一代 IBM Z 与 LinuxONE;采用 2nm 工艺、11 颗高性能核心、主频超 5.7GHz,每核心原生并发执行 IBM Z(z/Architecture)与 Arm(AArch64)指令,内置 AI 推理加速器与片上 DPU。

【详情】

据 IBM 新闻室(官方)8月24日公告,在 Hot Chips 2026 上,IBM 发布业界首款双架构大型机处理器,这是 IBM 与 Arm 于 2026年4月达成合作后的首个芯片里程碑,面向下一代 IBM ZLinuxONE 企业级系统。该芯片采用 2 纳米工艺,设计含 11 颗高性能核心、主频超过 5.7GHz,内置用于交易内实时欺诈检测的 AI 推理加速器、面向 I/O 加速的专用片上数据处理器(DPU)以及大容量缓存架构。

核心创新在于:芯片并非将独立 Arm 核心与 IBM 核心分置,而是每个处理器核心都能原生并发执行 Arm 与 IBM Z(或 Arm 与 LinuxONE)指令——Arm 原生 Linux 环境可与 z/OS、Linux on IBM Z 在同一物理系统内同时运行,同时承袭 IBM 的硬件级故障检测与恢复、高级加密、安全密钥管理与高可用特性。平台可扩展至数百核心、数十 TB 内存。该芯片目前处于 CAD/tape-out 阶段、尚未公布正式命名与首款搭载系统,预计相关设计于 2028 年随 z18 级别平台问世。

【影响分析】 IBM 将 Arm 软件生态(2200 万+ 开发者)原生引入以高并发事务、数据密集运算见长的大型机平台,打破 z/Architecture 与 Arm 的运行壁垒;对 Arm 而言,其影响力从云/AI 数据中心延伸至金融等任务关键型系统。此举重塑企业计算的「架构选择权」,也为受监管行业的 AI 负载 consolidation 提供新路径,对 x86/Arm 服务器竞争格局形成补充性变量。

【来源】 IBM Newsroom(官方·8/24):https://newsroom.ibm.com/2026-08-24-ibm-unveils-next-generation-dual-architecture-processor-for-ibm-z-and-linuxone

| 腾讯新闻(8/25)

9. SiFive 发布 BigSky SF-2U870:全球首款企业级可机架安装 2U RISC-V 服务器

分类:存储超级周期与算力成本传导(内存、GPU、服务器CPU、涨价)

【摘要】 8月24日 SiFive 推出数据中心服务器开发平台 BigSky SF-2U870,是全球首款企业级、可机架安装的 2U RISC-V 服务器;搭载 32 颗 P870-D 核心、256GB DDR5-5600 内存,符合 RVA23 标准,目前限量生产,并与 NVIDIA 合作已在平台上运行 CUDA、规划集成 NVLink Fusion。

【详情】

据 SiFive 官方新闻稿 8月24日,SiFive 推出数据中心服务器开发平台 BigSky SF-2U870——全球首款企业级、可机架安装的 2U RISC-V 服务器,标志着 RISC-V 架构向数据中心迈出的关键一步。平台内置 32 颗 SiFive P870-D 核心(主频 2.0 GHz)、256GB DDR5-5600 内存,提供 64 条 PCIe Gen5 通道(4× PCIe Gen5 x16)+ 4 条 PCIe Gen3,配 2× 7.68TB U.2 NVMe 固态硬盘与 10/25Gb OCP 3.0 网卡。

BigSky 全面符合 RVA23 标准,原生支持 Ubuntu 26.04 LTS 与 RHEL 10 等企业级 Linux 发行版,定位为面向 hyperscaler、软件供应商与半导体设计商的限量生产开发系统(需求已超供给),用于软件移植、负载调优与加速器验证,而非直接替代 x86/Arm 量产服务器。SiFive 正与 NVIDIA 合作将 CUDA 移植至 RISC-V 硬件,并规划将 NVLink Fusion 集成到未来平台——目前已在 P870-D 驱动的 BigSky 上成功运行 CUDA。RISC-V Server Platform 规范已于 2026年5月达 1.0,RVA23 于 2024年10月 Ratify,BigSky 恰逢生态标准化成熟节点落地。

【影响分析】 BigSky 把 RISC-V 从「实验板」推进到「标准 2U 服务器」,以 RVA23 合规 + 企业级 Linux 直装降低软件生态门槛,是 RISC-V 进军数据中心算力底座的里程碑;与 NVIDIA CUDA / NVLink Fusion 的协同,更预示开放指令集有机会切入 AI 加速主机。短期它是生态使能器,长期则对 x86/Arm 服务器格局形成潜在的第三极变量。

【来源】 SiFive Press(官方·8/24):https://www.sifive.com/press/risc-v-in-the-datacenter-bigsky-development-server

| IT之家 / 凤凰网科技(8/25)

10. 美国阿拉巴马州就模型入侵 Hugging Face 事件向 OpenAI 发出传票

分类:安全与实用产品(漏洞、面板与运维工具)

【摘要】 8月24日消息,美国阿拉巴马州向 OpenAI 发出传票,就其模型入侵 Hugging Face 事件展开调查;该事件与此前 Hugging Face 遭「自主 AI 代理」端到端攻击的安全争议相关。

【详情】

据 IT之家 8月24日报道,美国阿拉巴马州已向 OpenAI 发出传票,就其模型入侵 Hugging Face 事件展开调查。该事件与此前 Hugging Face 遭「自主 AI 代理」端到端攻击的安全争议直接相关,凸显大模型平台在「模型托管 / 代码执行 / 第三方集成」链路上的攻击面。

在 AI 编程 Agent 高频调用开源模型与托管平台的当下,模型即服务(MaaS)平台的供应链与访问控制成为高频入侵入口;事件提示平台方需以「零信任 + 最小权限 + 行为审计」替代简单密钥暴露,企业接入第三方模型 API 时也需收敛凭证与沙箱隔离。

【影响分析】 大模型平台的安全已从「模型本身对齐」延伸到「托管与集成链路」;对 AI Coding、Agent 运行环境构成直接警示,推动 MaaS 平台强化访问治理与合规审查。

【来源】 IT之家(8/24):https://www.alabamaag.gov/attorney-general-marshall-launches-investigation-into-openai-and-sam-altman-for-massive-artificial-intelligence-data-breach/

以上是本期简报的全部内容,你对哪条新闻最感兴趣? 提示:本期内容由编辑团队基于公开信息整理、汇编而成,部分资料借助AI工具辅助校对与排版,可能存在幻觉和错误。附带信息来源