北京时间9月10日凌晨1点,一年一度的“科技春晚”在苹果总部Apple Park拉开帷幕,新任CEO约翰·特努斯带来了包括首款折叠屏手机iPhone Duo在内的多款新硬件。就在此次活动结束后,苹果就马不停蹄地向用户推送了iOS 27 RC版系统更新。

在iOS 27 RC的更新说明里,苹果明明白白地写到,“更强大、更会聊天的Siri正在向用户推出,能理解个人上下文、操作 App、感知屏幕内容,还能调用广泛的知识库来帮你完成更多事”。
在谷歌Gemini大模型作为个性化Siri的核心引擎后,Siri AI终于可以用“真正懂你”来标榜自己了。
这一次Siri AI最大的卖点,是理解用户的个人上下文。比如,Siri与灵动岛深度绑定,执行过程会实时显示,它还能识别当前屏幕内容,并根据上下文执行操作。例如一句“把邮件里的餐厅预订加入日历”,它就会自动读取邮件、识别时间地点、创建日程,而不再像过去那样,只为用户弹出一个网页链接。
能理解个人上下文,为什么意味着Siri能真正懂你?阿里首席科学家周靖人在今年的外滩大会上就给出了答案,“在我们实际应用中,经常会感觉到一个模型对个人还不够理解,最主要是因为缺少上下文。而智能体系统能够把相关信息有效组织起来,真正让模型知道上下文,这样模型就会更加懂人。”

虽然目前国内用户暂时还用不了Apple Intelligence支持的Siri,但不妨碍大家借助互联网了解海外用户的吐槽,Siri AI早就被挂上了理解偏差、响应迟钝、逻辑混乱等负面标签。特别是当谷歌拿出Gemini Intelligence后,Siri AI更是堪称货比货得扔。
很多朋友第一次使用Siri AI在内的各类AI助手,都会经历一种分裂感。一方面,AI助手极其全能,写代码、改文案、做总结、画图表等工作都不在话下,可另一方面它又会频频掉链子,比如改文章时它只有一堆假大空的套话,做PPT时又记不住你的要求。
事实上,业界很早就发现了这种情况,并将其称之为“上下文饥饿”(Context Hunger)。其实不是模型不够聪明,而是它不知道把聪明用在你需要的地方。上下文是指大模型在单次对话或任务中能读取和记忆的全部信息,其中包括历史对话、指令、文件等,决定了AI能否连贯理解用户的意图。

在缺乏上下文内容的情况下,AI面对用户提出的需求,就不知道用户到底相信什么,自然也就只能泛泛而谈,给出一个似是而非、但不出错的结论。并且随着模型的能力越来越强,上下文饥饿导致的问题就愈发突出。这是因为模型越智能,它的脑补能力就会同步提升,更有可能一本正经地替你补完没说清的部分。
那么上下文不足,多给一点信息不就好了?事情远没有这般简单,AI需要的是与任务强相关的有效上下文。为此,有AI大神提出了所谓的上下文工程(ContextEngineering),通过给模型构建一个包含它完成任务所需的所有信息、背景和工具的世界,让模型拥有记忆力,从而实现你一张嘴,它就知道要干什么的效果。

那么问题就来了,有了上下文工程,为什么周靖人还会提及,在实际应用中,用户经常会感觉到一个模型对个人还不够理解?这是因为以往的端云混合型AI助手出于商业伦理的考量,默认不学习、不上传、不保存用户的对话内容,在底层就切断了从用户对话到模型训练的数据通路。
可反观Siri AI,苹果押注端侧AI模型,坚持隐私优先、本地推理的路线,在“个人上下文”领域获得了意想不到的收获。而端侧AI最大的优势,就在于数据存储在设备端,再搭配约200亿参数的端侧模型AFM 3 Core Advanced,Siri AI已经能做到记住你在哪天订了哪个酒店的房间,让你能够直接向Siri索要确认邮件。

发生在iPhone上的一切Siri都记得,也就难怪约翰·特努斯敢于表示iPhone是目前世界上最好的“智能个人中枢”。
【本文图片来自网络】
