苹果要造服务器了。距离上一台 Xserve 退役快 15 年,这家一直把心思放在手机和电脑上的公司,突然转头杀回企业级硬件市场。
据 The Information 报道,苹果正在研发一台 AI 服务器,核心是自家 M 系列 Ultra 芯片。这台机器会有两个版本:装两颗或者四颗未来推出的 M8 Ultra 芯片。计划 2029 年上市。
这事听起来反常,但你看看 OpenAI 在干什么就懂了。OpenAI 买了「好几万台」Mac mini 和 Mac Studio,专门用来训练 AI Agent,靠强化学习让模型自己试错摸索。Anthropic 也在 AWS 上租了一堆 Mac mini。Anthropic 创始人 Dario Amodei 之前在公开场合说过一句很有意思的话:「我们很多实验跑在 Mac 上,不是因为性能最强,而是因为最稳定。」
为什么这些搞 AI 的头部公司不去买 Nvidia 的 DGX 服务器,反而看上苹果的小机箱?两个原因:
(1) 推理便宜。AI 训练靠堆显卡,但推理阶段是长跑,跑几个月很正常。Mac 的能效比传统服务器高得多,电费省下来的钱比机器本身还贵。一台 Mac Studio 全天候运行一年,电费大概在 200 美金上下,同等算力的传统服务器要 1500 美金起步。
(2) 苹果的统一内存架构。Mac 用 CPU 和 GPU 共享一块大内存,跑大模型时不用在显存和内存之间来回倒数据,对小模型特别友好。M3 Ultra 最高配能塞 192GB 统一内存,等于直接干掉了 70B 模型最大的部署门槛。
新 CEO John Ternus 是这个项目的关键推手。一年前他还在管硬件工程的时候就把这事立起来了。9 月 1 号他从库克手里接过帅印,这台服务器要是真做出来,会是他任期内第一个大动作。Ternus 在内部被叫做「芯片工程师的工程师」,他比库克更懂硬件,也比库克更愿意碰企业市场。
有意思的是,苹果还在和 Nvidia 谈合作。他们想把多颗 M8 Ultra 用 NVLink Fusion 技术连起来。NVLink Fusion 是 Nvidia 专门给第三方芯片用的高速互联方案,理论上能把几十颗芯片拼成一台超大算力机器。这事一旦落地,相当于苹果借 Nvidia 的网络把自家芯片组集群,对抗 Nvidia 自家的 GB200 NVL72。
但这事没那么顺。三个变量在拉扯:
(1) 苹果的工程师习惯了封闭生态,跟 Nvidia 合作意味着开放部分内部架构。Apple Silicon 这套东西从第一天起就是「全栈自研」,连内存控制器都是自家设计。接 NVLink 等于在自己芯片里开一个 Nvidia 的口子,对工程团队的心理考验比技术考验更大。
(2) 项目随时可能被砍。The Information 自己也说,NVLink 方案可能根本不上马。苹果内部有好几个备选方案并行,最保守的版本根本不需要 Nvidia 参与。
(3) 内存芯片缺货。AI 数据中心把全球内存产能抢光了,Mac mini 和 Mac Studio 最近涨价就跟这有关。三星、SK 海力士、美光的产能 80% 都被 HBM 抢走,留给消费级 DRAM 的越来越少。
苹果上一次做企业服务器还是 2011 年的 Xserve。当时乔布斯砍掉这条产品线,理由是「桌面级 Mac mini 完全可以替代」。结果呢?十八年后,苹果带着 200 倍算力的芯片重新杀回来。Xserve 当年用的是 Intel Xeon,单台价格 3000 美金;这次的新机器光一颗 M8 Ultra 估计就要这个数。
这事的真正信号不在硬件本身,而在生态位。苹果发现:当 AI 行业进入「推理落地」阶段,最缺的不是算力最大的机器,而是最省电、最稳定的机器。而这恰好是 Mac 的传统强项。模型训完以后,部署到 Mac 上的成本,可能是部署到 H100 集群上的十分之一。
你还记得那个笑话吗——「苹果永远不会做服务器」。这次,它可能要重新定义这个词。18 年后再回头看,Xserve 砍掉不是苹果放弃服务器,而是等一个值得回来的时刻。