今日分析

AI 新闻里的变化、生意与判断。

007AI 助手 / 消费电子

Siri AI 终于能替你办事,但中国用户暂时用不了

苹果 9 月 14 日发布新一代 Siri AI:它能读取个人语境、理解屏幕内容并调用系统和第三方 App 完成操作。英语测试版已开始推出,中国暂不提供,欧盟也有首发限制。

AI 生成示意图、非事件现场、非产品界面:展示 Siri AI 的设备端处理、Private Cloud Compute、个人语境和应用操作关系;地区与语言标签依据苹果公告,不代表实际界面。
点击图片放大
01

Siri 这次多了什么

苹果 9 月 14 日发布新一代 Apple Intelligence,并把 Siri AI 作为英语测试版推出。它可以理解用户的消息、邮件和照片,结合屏幕上正在看的内容回答问题,还能继续调用系统和部分第三方 App。

苹果给的例子很具体:用户问家人之前提过什么活动,Siri 可以从消息里找到线索,再从邮件里找食谱,把材料放进提醒事项。用户看着球队网页询问主场比赛,Siri 可以把比赛加入日历。

它已经越过聊天框的边界。Siri 需要拿到个人资料、看懂当前屏幕,还要获得执行动作的权限。它从回答问题走到了替用户动手。

02

苹果押的是系统入口

Siri AI 可以从 iPhone 的侧边按钮或灵动岛唤起,也进入 iPad 和 Mac 的 Spotlight、系统上下文菜单以及 Vision Pro。苹果还新增了独立 Siri App,用 iCloud 在设备之间同步对话历史。

底层由设备端模型、Private Cloud Compute 和系统编排器一起工作。Spotlight 索引和 App Toolbox 等能力尽量在设备上处理,复杂请求再交给苹果的云端环境。苹果称,Private Cloud Compute 处理请求时不会保存或让苹果读取个人数据,并允许外部专家继续核验这项承诺。

这套设计的价值在于入口已经在操作系统里。用户不用先决定打开哪个 App,先说想做什么就行。能否执行,取决于系统权限和 App 有没有接好动作接口。

03

中国用户要等,原因苹果已经写明

Siri AI 目前从英语测试版开始,法语、日语、韩语、葡萄牙语和西班牙语计划下月扩展。苹果公告同时写明:它在中国暂不提供,原因是仍在处理监管要求;欧盟的 iOS、iPadOS 和 watchOS 也不会首发。

设备门槛也不低。新功能需要支持 Apple Intelligence 的设备和系统版本,包括 iPhone 16 系列及之后机型、iPhone 15 Pro 系列、M1 及之后的 Mac 和 iPad 等。设备支持不等于地区可用,语言、地区和具体功能还要分别核对。

所以这条新闻对中国用户的直接结论很简单:公告日能看到功能,不能据此推断在中国可以买到、装上就能用。苹果没有给出中国上线日期,也没有说明最终会保留哪些跨应用动作。

04

免费使用有上限,云端功能以后可能收费

苹果把大量能力放进日常应用:照片可以扩图和清理干扰,Safari 可以按主题整理标签并在商品补货或降价时提醒,Shortcuts 可以按描述生成自动化。它们都在争夺用户每天反复操作的那几分钟。

但服务器端模型并非无限使用。苹果写明,Siri AI、智能照片编辑、Image Playground 和 Shortcuts 的部分云端模型都有每日用量限制,限制会随功能、请求复杂度、系统需求和政策变化;未来会提供付费的扩展访问。

这意味着体验好不好,不只看模型回答得像不像人,还要看请求被送到哪里、一天能用几次、超限后怎么处理。苹果目前没有公布各功能的具体额度和收费表。

05

开发者要先准备动作,用户要先看权限

对 App 开发者来说,接入重点从“让 Siri 说出我的内容”变成“让 Siri 在我的 App 里完成一件事”。写邮件、加日历、查作业、保存旅行推荐,这些动作都需要明确的意图、数据权限和失败处理。苹果公告列出的 Outlook、Notability 和 Tripsy 仍有部分能力写作即将开放,说明第三方接入还在扩展。

对用户来说,个人语境越有用,授权范围就越大。消息、邮件、照片和屏幕内容被串起来后,错误动作的影响也会变大。先看哪些资料被调用、哪些操作需要确认,比追求一句话完成所有事更实际。

Siri AI 能否改变手机入口,要等第三方 App 覆盖、中文支持和地区政策都落地后再判断。现在能确定的,是苹果已经把系统级助手的验收标准从“会回答”推进到了“能完成”。

后续 6—12 个月 · 待核查问题

接下来怎么看

接下来要核对三件事:苹果何时给出中国的可用路径;中文版本会保留哪些个人语境和跨应用动作;第三方 App 的接入是否能覆盖常用工作。若这些问题没有答案,Siri AI 仍只是英语市场的测试版能力,不能当作全球统一的手机助手。

持续检查:中国和欧盟的上线范围与日期;中文 Siri 的数据处理方式;第三方 App 动作的实际覆盖;云端用量限制和付费规则。

往期分析

小红书开源 Iris,榜单分数要连 Harness 一起看

这次发布最有价值的地方,是把模型和 Harness 拆开报分。做搜索 Agent 时,工具、上下文丢弃、重试和评分器都会改结果;只截一行最高分,信息不完整。

长任务 Agent 会忘事,先别急着换模型

模型窗口再大,也装不下无限的工具结果。能否把旧信息放到可检索的位置,压缩后找回目标,并在出错时继续执行,决定了长任务能不能交付。

GitHub 把营销工作塞进 Issue,Copilot 负责起草,人仍要签字

这篇文章最有用的一点,是把 Copilot 放回流程里看:它起草名称和邮件,Issue、标签、Actions 负责执行,负责人继续签字。流程写不清,换模型也不会自动变好。

Claude 被用于导弹软件,Anthropic 没有说明何时发现

封禁账号可以停止后续调用,却无法收回已经写出的代码。判断平台是否及时干预,需要知道首次异常请求、人工调查和封号之间隔了多久。

DeepSeek V4.1 Flash:长任务 Agent 的成本账

缓存压缩降低了长任务的资源负担,能否转化成利润仍取决于复用比例和交付质量。值得优先试点的,是输入重复度高、结果可核验、出错后能恢复的流程。

AI 客服降本 65% 的案例里,真正值得重算的是哪笔账

AI 客服的价值要以问题解决后的总成本衡量。重复咨询减少后,人工会更集中地处理复杂工单;能否减少重复来单、控制错误操作并持续维护业务规则,比自动处理率更影响利润。