新环球脉搏 作者|刘敏 记者|宁晓文
9月27日 新环球脉搏今日新闻综合报道
一、终端AI算力新标杆:苹果Mac凭自研架构碾压x86平台,集群可跑1.6万亿参数大模型

在人工智能本地化部署飞速普及的当下,终端设备运行大模型的能力成为衡量硬件实力的全新核心标准。区别于传统x86架构电脑的算力局限,苹果全系设备依托独家自研架构,在本地AI推理领域展现出碾压级优势,甚至多款Mac设备成为开发者低成本搭建本地AI算力的首选设备。
近日,苹果在面向企业IT从业者的Jamf内部用户交流大会上,正式公开了旗下iPhone、iPad、Mac全产品线的本地大模型运行参数上限,清晰划定了不同设备的AI算力边界。根据官方实测数据,移动端设备中,iPhone与iPad可稳定运行最高140亿参数的本地AI模型;桌面入门级设备Mac Mini的算力上限可达700亿参数;专业创作设备MacBook Pro能够流畅驱动1200亿参数规模的大模型;而工作站级旗舰Mac Studio单机便可承载4800亿参数的本地AI运算任务。
更令人瞩目的是,苹果设备支持多机集群算力联动,仅需四台Mac Studio组建小型集群,就能实现1.6万亿参数超大模型的本地部署,完美适配DeepSeek V4 Pro顶级大模型的运行需求。这一突破彻底打破行业固有认知,无需投入数百万资金搭建大型服务器集群,依靠四台消费级工作站即可完成万亿级大模型本地化运营,大幅降低了高端本地AI的落地门槛。
苹果终端AI算力的核心竞争力,源于独家芯片级统一内存架构。旗下A、M系列处理器实现CPU、GPU内存资源全域共享,无需数据中转,带来极致的数据吞吐能力,这是传统x86架构设备短期内无法突破的技术壁垒。即便x86平台设备可通过硬件扩容搭载128GB、甚至AMD平台192GB大容量内存,但受限于架构短板,内存带宽表现差距悬殊。
数据对比显示,苹果Ultra级别M系列处理器内存带宽峰值可达1.2TB/s,而顶配x86平台256bit LPDDR5X-8000内存,带宽仅为256GB/s,五倍左右的带宽差距,让Mac设备的本地AI推理效率远超传统PC。目前x86阵营中,仅AMD锐龙AI Max(Strix Halo)系列处理器实现了内存共享能力,可支撑千亿级本地大模型运行,但整体运算效率仍远不及苹果Mac设备。未来英伟达RTX Spark系列有望改写格局,该产品集成RTX5070级别GPU核心与ARM架构CPU,最终体验将取决于微软对ARM架构Windows系统的优化落地效果。
二、马斯克全速冲刺AI赛道:百亿级GPU算力扩容,誓用半年时间追平行业头部梯队
为快速缩小与OpenAI、Anthropic等行业巨头的技术差距,马斯克持续加码AI算力基础设施建设,高调公布SpaceX AI超算集群的重磅扩容计划,以百万级高端GPU堆叠的硬核方式,全力冲刺全球AI第一梯队。
9月26日,马斯克在社交平台官宣SpaceX AI旗下Colossus 2超算数据中心的最新扩容时间表,明确2026年底前完成规模升级,将集群英伟达GPU总量扩充至121万颗,打造全球顶级AI算力集群。该超算中心坐落于美国田纳西州孟菲斯,是当前全球规模领先的商用AI超算项目。
截至目前,Colossus 2已完成55万颗高端GPU的部署落地,包含11万颗英伟达GB200与44万颗GB300芯片。后续扩容工作分三批有序推进,节奏清晰、落地高效:首批22万颗GB300芯片将于下周正式投入商用运行,第二批同等数量芯片定档11月上线,第三批22万颗GB300芯片计划12月底全部到位。整体扩容完成后,Colossus 2集群算力规模将较现有水平提升120%。
叠加Colossus 1存量算力硬件(15万颗H100、5万颗H200、3万颗GB200),SpaceX AI整体运营的GPU总量将突破144万颗,其中仅新一代GB300芯片占比就高达110万颗。据第三方行业机构测算,整套硬件设备的采购总价值超500亿美元,折合人民币约3355亿元,算力投入规模堪称行业顶级。
算力硬件的规模化落地,也带来了稳定的商业变现能力。目前SpaceX AI两大超算数据中心总算力突破2吉瓦,配套自建电厂规划容量达1.2吉瓦,可实现算力自给自足与稳定输出。谷歌已正式签约采购其算力资源,自10月起,每月算力使用费将增至9.2亿美元(约61.7亿元人民币),商业价值持续释放。
谈及行业竞争,马斯克坦言SpaceX AI仅三年发展历程,远不及OpenAI十年、Anthropic六年的行业积累。但依托极速算力扩容节奏,品牌有望在未来两至三个月,推出对标Anthropic Fable、GPT-6水准的顶级大模型,预计半年内即可跻身全球AI行业第一梯队。目前新增算力硬件全面适配英伟达Blackwell架构,不过海量硬件堆叠能否彻底转化为Grok系列模型的性能飞跃,仍需等待后续产品迭代落地验证。
三、AI算力行业双轨发展:云端超算与终端本地推理形成互补新格局
随着AI技术持续迭代,当前全球算力行业已形成云端巨型超算集群与终端本地智能推理双轨并行的发展格局,两条赛道各有优势、互为补充,共同推动AI技术从云端专属走向全域普及。
以苹果Mac全系设备为核心的端侧本地推理方案,主打轻量化、高隐私、低延迟优势,高度适配个人开发者、小型工作室及企业轻量化AI使用场景。依托独家统一内存架构,少量终端设备即可完成千亿、甚至万亿参数大模型的本地运行,无需依赖云端网络传输,所有数据留存本地,从根源规避数据泄露风险。同时设备采购、部署成本极低,无需搭建专业机房,大幅降低AI落地门槛。但该方案存在明显短板,集群扩展能力有限,仅适用于模型推理场景,无法支撑超大模型的高强度训练工作。目前AMD、英伟达持续发力消费级终端AI市场,但系统适配、软件优化层面仍有较大提升空间。
而SpaceX AI百万级GPU超算集群代表的云端算力赛道,是前沿大模型训练、规模化商用算力租赁的核心支撑。这类巨型算力集群依靠海量高端GPU堆叠,输出吉瓦级超强算力,能够承载最先进大模型的迭代训练、参数调优、数据运算等高强度工作,同时可为谷歌等科技巨头提供算力外包服务,商业化价值巨大。但该模式存在极高的行业门槛,不仅需要数百亿级资金投入,还需配套专属电厂、散热系统、专业机房等基础设施,仅头部科技企业能够布局,属于重资产、高壁垒的巨头赛道。
从行业长期趋势来看,两条算力赛道并非竞争替代关系,而是协同共生、相辅相成。云端超算承担大模型的核心训练、迭代升级工作,完成训练的成熟模型经过压缩、适配优化后,可下放至手机、Mac等终端设备,实现本地低延迟推理。未来AI行业将全面迈入“云端训练+终端推理”的协同模式,兼顾模型迭代速度、商用落地效率与数据隐私安全,推动人工智能技术全方位普及落地。
四、国产潮玩藏品出海提速:懂淘亮相戛纳TFWA免税展,开拓全球高端文旅零售新赛道
据彭博社权威消息,国内知名跨境藏品交易平台懂淘Dongtao(懂宝Dongbay)正式成为法国戛纳TFWA世界免税展官方赞助商,成功登陆全球顶级旅游零售行业盛会,标志着国产潮玩、卡牌、文创藏品正式进军全球高端免税与旅游零售市场。
TFWA戛纳世界免税展是全球旅游零售、免税行业的标杆性顶级峰会,常年在戛纳节庆宫盛大举办,拥有极高的行业权威性与全球影响力。展会仅面向全球行业专业客商开放,不对外开放普通观众,每年汇聚全球奢侈品、美妆香氛、高端酒水、精品食品等全品类头部品牌方,以及全球各大机场、免税零售商、行业采购决策人。作为跨境高端消费领域的核心商务对接平台,展会持续为全球客商提供新品首发、商务洽谈、行业峰会、资源对接等一站式服务,每年吸引数千名全球行业高管参会合作,是链接全球高端消费市场的核心枢纽。
本次出海参展的懂淘平台,深耕游戏周边、数码潮玩、TCG集换卡牌、艺术收藏藏品等细分赛道,搭建了集藏品专业核验、交易资金担保、跨境履约配送于一体的完整服务链路,服务全球范围内的藏品收藏爱好者与跨境商户。近年来,平台持续深耕全球化布局,多次赞助海外顶级收藏类行业展会,持续打通海内外藏品交易渠道,搭建全球玩家与商户的交流互通桥梁。
此次携手戛纳TFWA顶级免税展,是懂淘全球化战略的重要一步。平台将依托展会覆盖全球的商贸资源与高端行业影响力,探索潮玩、卡牌、文创藏品与旅游零售、免税消费场景的全新融合模式,打破传统藏品交易的地域局限。通过接轨全球高端消费市场,进一步提升国产文创潮玩的国际知名度,拓展多元化国际合作渠道,助力国内优质收藏文创品类走出国门,实现跨境流通与全球化商业化落地。#阿里巴巴#字节跳动#懂淘#懂宝#腾讯
编辑 | 王庆
责编 | 陈伟
审核 | 李一佳