‘确实能用了——但只有一半’的评价
iOS 27公开测试版的主流评价呈现出两极分化。一方面,苹果承诺了两年的个人上下文层确实实现了:实测演示显示,Siri能回忆起几周前聊天中提到的水杯品牌,从4万张照片库中调出驾照号码,并从旧消息中提取出精确的维修报价。AppleTrack的总结很直接——苹果终于修好了Siri,现在它能可靠地回答十分之九的问题。社交媒体情绪也普遍正面甚至惊叹,苹果观察者惊讶于这次助手真的能用了。
另一方面,操作层仍只完成了一半。同一批称赞记忆能力的评测者也目睹了Siri在创建Freeform白板或向文档添加页面时失败,AppleTrack总结称,Siri另外50%的功能仍未完成。彭博社的Mark Gurman发现助手在移动日历安排和从屏幕邮件创建事件方面功能正常,但认为对任何用过现代AI助手的人来说都不算惊艳,认为Siri大致处于ChatGPT、Claude和Gemini约六个月前的水平 [8]。MacRumors的实测测试员更严厉,称其功能相比竞品极其有限,并指出自动纠错能力差 [4]。共识并非Siri糟糕——而是苹果只发布了容易且令人印象深刻的那一半,把困难且具备代理能力的那一半留到了以后。



