你向企业里的AI助手提一个问题,真正给出回答的,往往不是训练模型时使用的机器,而是另一类服务器:它们运行已经训练好的模型,处理每天不断涌入的实际请求。这叫AI推理服务器。苹果现在考虑把自己的芯片装进这类机器,并借用英伟达的连接技术,让多颗芯片一起工作。
这件事值得关注,不是因为苹果准备采购英伟达GPU。更准确的说法是:苹果可能继续以自研芯片为核心,只把英伟达的数据中心互连体系接进来。若方案落地,苹果的垂直整合——把芯片、硬件和软件尽量掌握在自己手中——将从终端设备进一步延伸到AI基础设施。
不过,目前全部关键信息都来自单一报道。Reuters转述了The Information的消息,但表示无法独立核实;苹果和英伟达也未立即回应置评请求。
苹果想造什么?
据The Information报道,苹果正考虑推出面向企业的AI服务器,由规划中的自研M8 Ultra芯片驱动,可能配置两颗或四颗,主要服务于AI推理,而非训练基础模型。
这里最容易产生的误解,是把它理解成“苹果改用英伟达芯片”。报道指向的其实是NVLink Fusion。它允许其他厂商的定制芯片接入英伟达的数据中心互连体系。在这个方案里,负责计算的仍可能是苹果芯片;英伟达提供的更像是一套高速协作通道,帮助多颗芯片交换数据。
这也解释了苹果为何可能需要一个合作伙伴。单颗芯片能独立处理任务,多颗芯片共同承担更大的推理负载时,则需要足够快的连接。NVLink Fusion可能补上这块能力,同时让苹果保留自研芯片路线。
“重返”从何说起?
苹果并非从未做过服务器。它在2002年推出机架式服务器Xserve,并于2010年宣布该产品线将在次年停产。所谓“重返服务器市场”,正是以这段历史为参照。
当年的Xserve还曾进入大型计算项目。根据Apple Newsroom和Virginia Tech的资料,Virginia Tech在2003年用1100台Power Mac G5搭建“Big Mac”超级计算机,一度位列全球TOP500第三名,随后又换成密度更高的Xserve G5。此后苹果退出了标准机架式服务器市场。
如今讨论中的产品,方向已经换成企业AI推理。报道预计它最早可能在2029年上市。这个时间点意味着,它更像一项远期基础设施选择,而不是已经准备发布的产品。
真正变化的是边界
如果苹果推进该项目,它就不只是为终端设备设计芯片,还会把自研计算能力伸向企业服务器。对苹果而言,这是垂直整合边界的外扩;对英伟达而言,则意味着其数据中心技术可能进入一套并不以英伟达GPU为计算核心的系统。
这条路线也可能改变苹果与云端供应商之间的关系。企业AI请求若能在苹果自己的服务器体系中处理,哪些能力由苹果掌握、哪些继续交给外部云端,就需要重新划分。不过,现有材料没有披露苹果当前相关供应商、部署方式或商业模式,因此还不能判断影响会落到谁身上、规模多大。
局限与未知
- 项目仍在评估,可能取消,也可能最终不采用英伟达技术。
- 报道没有说明具体合作模式、投入规模,以及“服务器市场”覆盖的业务范围。
- 最早上市时间为2029年,且Reuters无法独立核实消息;目前不能把它写成已经达成的合作或已经确定的产品计划。