WWDC 2026:苹果发布新一代Siri AI,采用Gemini衍生模型,开发者可通过Core AI库在本地运行PyTorch模型
苹果在WWDC 2026上宣布了新一代Siri AI,通过视觉LLM提取屏幕信息,无需应用单独适配。同时推出Core AI库,支持开发者将PyTorch模型在Apple硬件上本地运行。本文分析这些更新对中文开发者和用户的实际影响。
一句话看懂
苹果在WWDC 2026发布新一代Siri AI,采用定制Gemini模型,通过视觉LLM理解屏幕内容,并推出Core AI库让开发者本地运行PyTorch模型。
详细发生了什么
苹果在2026年WWDC上发布了新一代Siri AI,这次没有重蹈2024年Apple Intelligence画饼的覆辙。新Siri AI的核心是苹果从Google授权的一个定制Gemini衍生模型,运行在苹果自己的Private Cloud Compute上,同时结合了视觉LLM技术——通过分析用户屏幕截图来提取信息,这样现有应用无需编写额外代码就能与Siri AI集成。
此外,苹果推出了Core AI库,这是一个Python包,桥接了PyTorch和Core AI。开发者可以将已有的PyTorch模型(通过torch.export.ExportedProgram导出)转换为Core AI的AIProgram,从而在Apple硬件(如iPhone、Mac)上高效运行。Core AI与Meta的PyTorch生态系统深度整合,提供了Core AI PyTorch Extensions(coreai-torch)。
目前iOS 27 Developer Beta已开放,但新Siri AI需要等待名单才能体验。MacRumors的Aaron Perris已通过等待名单,预计很快会有更多实测报告。
中文圈视角
对中文用户和开发者来说,这次更新有几个关键点:
-
Siri AI的可用性:新Siri AI基于Gemini模型,但苹果将其运行在自己的私有云上,这意味着数据不出境?实际上,Private Cloud Compute是苹果的服务器集群,可能位于美国,因此数据隐私和合规性仍需关注。对于国内用户,Siri AI的响应速度和功能可能受网络影响,且是否支持中文场景(如微信、支付宝)尚未明确。
-
Core AI库的国产平替:Core AI让开发者能在Apple硬件上本地运行PyTorch模型,这类似于华为的MindSpore或小米的MACE。但Core AI直接兼容PyTorch生态,降低了迁移成本。对于国内AI开发者,如果使用Apple设备(如MacBook),可以更方便地部署模型,而无需依赖云端。不过,国内主流模型(如DeepSeek、Qwen)是否适配Core AI还需观察。
-
视觉LLM的潜力:通过屏幕截图理解应用内容,这在国内的“智能助手”中已有类似尝试(如小爱同学的屏幕识别),但苹果的方案更底层,无需应用适配。对中文用户,这意味着未来Siri可能直接读取微信聊天记录或外卖订单,但隐私风险也随之而来。
-
监管与合规:苹果的私有云计算强调数据不出设备,但视觉LLM需要截取屏幕,这在国内的《个人信息保护法》下可能面临挑战。苹果需要确保用户数据不被滥用,且符合数据本地化要求。
几条值得记住的细节
- 苹果从Google授权了定制Gemini模型,用于新Siri AI,运行在Private Cloud Compute上。
- 视觉LLM通过分析屏幕截图提取信息,无需应用单独集成。
- Core AI库支持将PyTorch模型转换为Apple硬件可执行的AIProgram。
- iOS 27 Developer Beta已开放,但新Siri AI需要等待名单。
- Core AI PyTorch Extensions(coreai-torch)是开源的Python包。
一句话总结
苹果终于拿出了可行的Siri AI方案,但中文用户能否用上、数据是否合规,仍需观望。