过去一年,AI编程和办公工具在PC端快速普及,手机上的AI体验仍以单次问答和图片处理为主。高通在2026年骁龙峰会上想说明,端侧AI正进入更多生活和工作场景。

峰会展示了一个案例:高通与阶跃星辰、无量火科技、江波合作,用端侧30B-MoE模型完成一条工作链,本地模型读懂邮件,提取行程信息,同步日历,推荐航班和酒店,再草拟回复。任务需要理解、规划和连续执行,且完全在端侧完成。高通公司总裁兼首席执行官安蒙表示,智能体AI不只是为终端新增功能,而是创造了新的终端工作流程。

2024年,高通自研Oryon CPU搭载在手机上,展示端侧大模型可能;2025年第五代骁龙8至尊版引入Personal Scribe和个人知识图谱,把直接智能体写入产品方向。2026年,第六代骁龙8至尊版与超级至尊版双旗舰均采用2nm工艺。超级至尊版频率拉到5GHz,CPU负责任务调度和工具调用,NPU承担模型推理,低功耗感知单元处理后台信息,为不同AI工作分配计算通道。

AI不再只在用户提问时工作,还要在后台保留信息、等待时机并接续任务,缓存、内存带宽和低功耗感知因此重要。高通称新双Micro NPU架构性能提升85%,功耗降低20%,可提升Personal Scribe能力,带来低时延、离线可用和减少数据上传的潜力,复杂任务仍可调用云端。本次峰会上,30B MoE模型在参考设计上完成邮件理解、行程规划和日历同步。更复杂的应用也可由多个模型分工完成:Deepgram展示的AI播客应用中,NPU上的语音模型负责转写并区分发言者,GPU上的Gemma模型理解话题、生成追问建议;工作人员提到,应用仍需联网检索核查。AI智能眼镜也是一个典型。