4台Mac Studio跑通万亿参数模型,苹果向英伟达的推理叙事发起挑战
华尔街见闻发布于 2026/09/24 09:00:00苹果
要点总结:
- 事件:苹果发布M5 Ultra版Mac Studio(9月22日开始交付),最高支持512GB统一内存,并支持多机集群分布式推理。苹果曾演示4台Mac Studio联合运行万亿参数模型,10月下旬将有512GB配置到货。
- 核心叙事变化:苹果从“卖能用AI的设备”转向“卖能跑AI的设备”(本地推理)。苹果高管指出,企业一次性买断设备后,可免去按令牌计费的云端推理费用,对于负载稳定的团队,本地算力在经济性上可能优于长期租用云GPU。
- 对英伟达的影响:若更多推理迁移至终端或企业自有服务器,英伟达在AI推理增量市场可捕获的份额可能低于当前市场预期,但这并不意味着英伟达会失去现有订单——其仍在产业链与云端使用中。
- 关键不确定性:推理速度、并发能力与总体拥有成本(TCO)相比云端租赁的优劣,以及企业是否实际采购本地方案,才是决定性因素。苹果的演示具备可行性,但真实场景表现待验证。
- 市场与策略影响:英伟达股价缺乏中期趋势、隐含波动率处于低位,期权市场未充分为“推理向本地迁移”这一风险定价。高盛等机构建议可用期权(买入英伟达看跌、苹果看涨)来表达这一判断。
- 后续可关注点:10月下旬512GB版到货后的实测推理速度、并发与TCO数据,以及企业客户的采购与部署反馈。
评论摘录:有用户提出“推理模型不是之前就已经被做过了?”,实质上该评论在质疑新叙事的创新性——回应上看,关键是苹果将终端/企业本地算力做到了能承载更大模型与多机协同,从“能用AI”升级为“能跑AI”,这才构成对云端计费模式和硬件竞争格局的潜在冲击。