在今年的 WWDC 主题演讲上,苹果宣布彻底重构了端侧 AI 基础设施:服役九年的 Core ML 被一刀砍掉,取而代之的是专为大模型时代从头编写的 Core AI 框架。这一动作被外界视为库克任内最后一次 WWDC 中最激进的架构变革。
Core AI:从第一行代码为大模型而生
Core AI 不再沿用传统机器学习框架的设计思路,而是原生支持自回归生成、流式响应和多轮对话等大语言模型核心能力。它统一调度 CPU、GPU 和 Neural Engine 三颗芯片,覆盖 iOS 27、macOS 27 直到 watchOS 27 的全平台。简单来说,Core ML 是为分类、回归等传统任务服务的,而 Core AI 则是为 GPT 式的大模型量身定做。
配套工具链也全部焕新。苹果推出了 .aimodel 模型格式,开源了 coreai-torch 转换工具包,Xcode 中新增了性能调优和提前编译功能,从模型转换到部署上架的整条链路都被重新梳理。开发者只需几行 Swift 代码就能在 App 里加载本地模型,完成图像识别、语义分割、语言生成等复杂任务。
一个典型的例子是语言学习 App:学生拿起手机对准一只蜂鸟,SAM3 模型在端侧同时完成物体识别和前景分割,生成一张干净的卡片配图;随后一个 0.6B 参数的 Qwen 模型接手文本部分,将识别结果转化为结构化单词卡(中文词、英文释义、例句)。整个流程不联网、不调 API,全部跑在手机本地。
200 亿参数模型藏在闪存里
苹果此次发布了与谷歌联合开发的第三代自研模型家族 AFM 3,共 5 个模型。端侧两款:3B 参数的 AFM 3 Core 负责日常轻量任务;20B 参数的 AFM 3 Core Advanced 是苹果端侧天花板。云端三款:AFM 3 Cloud、ADM 3 Cloud(专注图像)和 AFM 3 Cloud Pro(全家族最强)。
其中最引人注目的是端侧大杀器 AFM 3 Core Advanced,拥有 200 亿参数。传统大模型要求所有权重常驻 DRAM,200 亿参数连桌面设备都吃力。苹果的解法是 Instruction-Following Pruning:完整模型存在闪存(NAND)里,收到请求后轻量级路由模块选出需要激活的专家,仅将这部分权重加载到 DRAM。每次实际调动的参数量在 10 亿到 40 亿之间,取决于任务复杂度——干活时只用 5% 到 20%,剩下的安静躺在闪存里等召唤。
实测结果佐证了这套架构的效果。AFM 3 Core 在 45.6% 的测试 prompt 上被判定优于上一代,上一代的优势率只有 23.3%。云端的 AFM 3 Cloud 差距更夸张:64.7% 对 8.7%,几乎单方面碾压。
Foundation Models 框架:统一所有模型的路由层
苹果不止想跑模型,更想统一所有模型。新引入的 Foundation Models 框架中定义了 Language Model 协议,任何模型只要遵循它,就能被同一套 Swift 代码调用。苹果自家的端侧模型、Core AI 跑的开源模型、以及 Claude 和 Gemini 这样的云端大模型都遵循该协议。一套代码,三种模型,从本地到云端无缝切换。
苹果把自己变成了 AI 的路由层。对于开发者,如果 App 在 App Store 的首次下载量低于 200 万,Private Cloud Compute 的云端推理完全免费——零 API 成本、零 token 费用。这个门槛精准卡在了独立开发者和中小团队的位置上。
Anthropic Claude 率先接入:十亿用户级分发通道
在第三方适配中,Anthropic 最先交卷。6 月 8 日 WWDC keynote 结束后当天,Anthropic 发布了 Swift 包,正式接入 Foundation Models 框架。思路清晰:苹果端侧模型擅长摘要、信息抽取等轻量任务,速度快、不联网、零成本;但遇到多步推理、代码生成、联网搜索时,端侧模型扛不住。Claude 的 Swift 包精准卡在这个接缝上:开发者在 Foundation Models 框架中正常调用苹果端侧模型,当任务超出能力时,框架自动把请求路由给 Claude,响应以流式方式返回到同一个 SwiftUI 视图里,用户全程无感知。
对 Anthropic 而言,这是一张迟到但关键的消费级分发入场券。Claude 在开发者和企业市场打得很猛,但在普通消费者面前几乎没存在感。如今苹果的 Foundation Models 框架给了它一条触达十亿量级用户的通道。此前 Claude Agent 已整合进 Xcode 26.3 面向开发者,这次面向的是 App 的最终用户。
苹果的 AI 擂台:25 亿设备的选择权交给用户
回看库克最后一届 WWDC 的全部动作,一条线索贯穿始终:苹果不想做 AI 模型公司。它把 Siri 的大脑交给谷歌,把开源模型的运行时交给 Core AI,把第三方 AI 的选择权交给用户。它要做的是擂台——25 亿台设备,统一的 Language Model 协议,从端侧到云端的完整调度框架。谁的模型好,谁就能通过这个平台触达地球上最大的高价值用户群。
AI 巨头之间的竞争从此多了一个新维度:之前 Anthropic 和 OpenAI 抢的是 API 调用量、开发者工具、企业合同,现在苹果把战场搬到了每个人的口袋里。谁能拿下那个「默认 AI 引擎」的位置,谁就赢了下一局。9 月 1 日,John Ternus 将接任苹果 CEO——他继承的不只是一家硬件公司,还有库克留下的这座 AI 擂台。