三星从新西兰找来一位名叫 Tim Cook 的当地居民,为自家的折叠屏 Galaxy Z Fold 8 宣传。这种借势式营销效果如何另说,但能看出当苹果进入别人的地盘时,友商多少会有些反应。而现在,压力可能轮到戴尔、HPE、联想这些企业服务器供应商了。

苹果或推 AI 服务器:M8 Ultra 双芯四芯配置,最早 2029 年上市

据 The Information 报道,苹果正在考虑开发面向外部客户的 AI 服务器,可能会出现两颗和四颗 M8 Ultra 两种配置,并可能使用英伟达 NVLink 互联技术连接。该项目已推进接近一年,启动之初得到当时负责硬件工程、如今已出任苹果 CEO 的 John Ternus 首肯。不过产品不会很快面世:即便最终发布,也要到 2029 年才可能上市,而且仍有取消的可能。自 2011 年 Xserve 退出后,苹果一直没有再碰企业服务器市场。

需求端的变化更为直接。近两年,企业市场对 Mac mini 和 Mac Studio 的追捧有目共睹。不少前沿实验室和云服务商把多台 Mac mini 装进机柜,作为云端托管的 macOS 实例运行 Agent 产品,并采集行为轨迹数据,用于优化模型和产品本身。OpenAI 据传已囤积数万台苹果电脑,Anthropic 在亚马逊 AWS 上大量租借 Mac 算力实例,第三方托管商还专门为大批量部署 Mac 设计了机架。当下 AI 竞赛的重心转向后训练和 Agent 能力,尤其是操作电脑的能力,而 macOS 只能在苹果硬件上运行的授权限制,让普通服务器很难用虚拟机或“黑苹果”替代。

苹果从 M1 时代坚持的统一内存架构,也在推理场景中显出价值。大模型推理不仅依赖算力,同样吃内存和带宽;传统架构中内存与显存彼此隔离,数据通量大时容易出现拥堵和延迟。Apple Silicon 允许 CPU 与 GPU 共享同一片内存池,最新 Mac Studio 上的 M5 Ultra 统一内存最高可达 512GB,带宽 1.2TB/s,足以把原本需要多张专业 GPU 才能装下的模型权重完整载入。对于模型较大、并发不高的推理场景,这套方案颇具吸引力。随着年初 OpenClaw 及后续一批 Agent 产品走红,需求传导到消费端,Mac mini 发货延迟一度长达一个月甚至更久,新款产品明显涨价,Mac 产品线季度营收同比增长 29%。