今年高通骁龙峰会最关键的主题,无疑是新旗舰和智能体。

此次活动首日,高通发布了第六代骁龙8至尊版与第六代骁龙8超级至尊版双旗舰平台,荣耀、小米、moto轮番登台,展示了能自己读邮件、订行程的手机AI。

紧接着,我们三易生活围着QRD(高通参考设计)跑分到满头大汗。芯片、算力、帧率,显然是此次活动的主角。

在今年骁龙峰会Demo区的一个角落,国内存储厂商江波龙(Longsys)的展台藏着一个可能更现实的命题,那就是智能手机到底要花多少钱,才能将AI真正揣进口袋?
手机AI“用不起”怎么办?江波龙端出解决方案
先说一个技术常识。对于传统的AI手机而言,要想运行端侧大模型,首先就需要将整个模型加载进内存。
这是因为内存的速度足够快,而且在现代的手机SoC里,CPU、GPU、NPU都可以直接从内存中读取数据。

但这就很直接地带来了一个问题,那就是要想跑足够大的端侧模型,内存就既要足够快,还要足够大。说得更直白点,也就是会大幅提升硬件成本。而且一旦内存频率较低或是容量“不够夯”,那么AI功能要么就效果打折扣,要么就直接不能用。

面对这样的情况,江波龙想出了反其道而行之的办法。他们将大模型本体“常驻”在手机的UFS闪存里,不用整体搬进内存。而在内存中,只存放当前推理真正“激活”的那一小部分。这背后就是MoE(混合专家)模型的特性,大模型被拆成许多个“专家”子网络,每处理一个词只调用其中少数几个,其余则完全不工作。
但是这种工作模式也有一个很大的问题,那就是闪存要承受高频、随机、小块的动态读取。如果是普通的闪存芯片,一旦读取性能跟不上,AI就会“卡壳”,甚至因为这样的频繁读取而导致闪存快速老化、损坏。

为此,江波龙开发了特制的UFS 5.0高性能主控与专门针对AI用例的固件逻辑。在演示区的屏幕上,可以看到300亿参数MoE模型的Prefill速度达到296.2 TPS、Decode速度29.2 TPS。同时因为有了特制的软硬件设计,这种“为AI而生”的新款手机存储芯片,长期寿命还会比现在的方案要好得多。
正如在展位Keynote中所示的那样,在不损失推理精度的前提下,江波龙这种“在闪存里跑大模型”的设计,能让手机内存需求降低超过50%。消费者不需要买价格更贵的大内存型号,也能享受顶配同款的AI功能。
让更大的模型跑在手机上,还有一个额外好处
江波龙这一闪存方案的另一个好处,在现场演示中也一目了然。

屏幕上,手机显示“收到一封骁龙峰会邀请邮件”。接下来,智能体会自动消化内容,联动联系人、日历和旅行偏好,分6步完成全部安排:添加日历事件、生成行程、准备航班演示、推荐酒店、分享行程、保存RSVP草稿。每完成一步,节点亮起一个对勾,最终弹出“Agent completed”(智能体已完成)。
据悉,该演示是由InfrisAI、StepFun(阶跃星辰)、江波龙与高通四方联合完成,300亿参数的StepEdge-Omni MoE模型运行在第六代骁龙8至尊版超级版工程机上。

关键在于,整个过程模型完全运行在手机端。出差行程、航班、酒店、联系人都是敏感的个人信息,当模型本体就在闪存里、计算全在本地完成,这些信息没有一个字节需要上传云端,自然就不存在传输环节的泄密风险。
省钱,是江波龙闪存方案的第一本账,而隐私,则是第二本账。
跑分成绩和市场,都在给江波龙“投票”
值得注意的是,江波龙此次展出的方案并非“孤证”,它的方向与高通的工程选择、量产市场的商业选择高度一致。

就在此次活动期间,我们三易生活实测了两款高通的工程样机,其中一款为LPDDR5X内存配UFS 5.0闪存,另一款则是LPDDR6内存配UFS 5.0闪存。虽然内存不同,但闪存却统一为UFS 5.0。

从实测的安兔兔成绩来看,LPDDR5X机型为5610139分,LPDDR6机型是5688477分,差距仅1.4%。

很显然,无论是高通工程样机的硬件设计,还是我们的跑分成绩,都传达出一个同样的结论:UFS 5.0是这代旗舰机型不可省略的底座,看似带宽暴增的LPDDR6内存,实际性能边际收益却相当有限。
而在终端市场会发现,各厂商的选择更加直白。因为截至目前,所有已经官宣的本世代骁龙、天玑旗舰机型,无一采用LPDDR6内存,原因其实很简单:太贵。

如此一来,看似直接易行的“堆内存跑大模型”做法,在如今的市场状况面前根本走不通。更不要说模型规模还在变大,内存性能的增长注定追不上。这个缺口,恰好就可以由江波龙主导的闪存AI方案进行填补,用便宜得多的闪存承接模型本体,将内存留给真正激活的部分。
为什么是江波龙?这其实是个简单的商业问题
当然,熟悉手机硬件的朋友可能会问,这件事为什么是由江波龙做成,而不是大家更熟悉的三星、海力士、美光?
在我们三易生活看来,原因未必是技术落差,更可能是一道商业上的选择题。毕竟,三家大厂既产内存、又产闪存。大家都知道LPDDR6内存单价高、溢价丰厚,这种情况下,他们如果力推“让客户少买贵内存”的闪存AI方案,就等于用便宜的产品线抢了自家更赚钱的内存生意。谁又会愿意去这样做呢?

江波龙则不同。作为以闪存为主的厂商,它并无自研内存晶圆/颗粒业务,没有左右手互搏的包袱。如此一来,让闪存承担“AI手机”的关键角色,对他们而言就是纯粹的机会。

更为重要的是,江波龙带来的并非Demo。我们在与江波龙方面相关人士沟通后得知,他们目前能透露的客户“几乎是所有国内厂商”,其中就包括此次骁龙峰会上刚刚官宣新机的moto。

众所周知,今年整场骁龙峰会期间、整个手机行业都在宣告智能体时代的到来。但要想让智能体“住进”数亿台手机,已经不可能只靠算力、成本堆砌去解决问题。

当端侧AI的瓶颈从“算得动”转向“装得下、用得起”,存储架构的革命就悄然站到了舞台中央。江波龙的分量,不在于展台大小,而是他们率先趟出了一条平台认可、市场需要、巨头却不愿走的路。端侧AI普及的关键一环,可能正握在这家专注闪存的中国厂商手中。
