AI 手机的概念喊了好几年,阿里这次把底座直接摆了出来。9 月 22 日云栖大会上,阿里千问发布 AI 手机全栈解决方案 Qwen Intelligence—— 不碰硬件生产,专门给手机厂商当「模型 + 平台 + 场景方案」的一站式 AI 底座。

方案的核心是一套系统级 Agent Harness 架构,内置三大 Agent。Mobile Planner Agent 当手机「大脑」,理解复杂需求、拆任务、编排工具、动态调整;Mobile-Use Agent 干跨 App 的活,查找信息、填表单都归它管,配了三层安全隐私管控;Mobile Creative Agent 管影像创作,一句话描述需求自动拆成工作流,首图生成只要 3 秒。数据上阿里给的是端到端任务成功率 90%,任务完成时间压缩 28.8%,费用降低 20%;Planner Agent 每千次任务调用成本约 2.41 美元。
技术细节方面,Mobile Planner Agent 当手机大脑,核心是「模型 × Harness 协同演进」加双层记忆——模型负责理解、规划与决策,Harness 管理状态、记忆与技能,工作记忆随任务演化,长期记忆把短期经验沉淀成用户画像。
操作侧的 Mobile-Use Agent 是这次数据最扎实的部分。它走「API 优先 + GUI 兜底」的混合模式,在 MobileWorld(82.1)、MobileWorld-Real(92.2)、AndroidDaily(97.2)等六项主流评测中得分均位居前列;端到端实测任务成功率达 90%,高于头部方案 3 个百分点;一次任务完成时间从 83.6 秒压到 59.5 秒,下降 28.8%;费用降低 20%;安全评分高出头部方案 23 个百分点。

创意侧的 Mobile Creative Agent 冲的是「一句话直出」:把口语表达拆成工作流,规划模型把意图转成清晰指令,用户不用会写提示词。模型侧靠轻量模型的蒸馏和强化学习,把生成过程从 100 步压缩到 8 步,首图生成只要 3 秒,相对头部竞品平均提速 2 倍。

配套还开放了四套评测集,覆盖规划、执行、真机、安全四个维度:MobilePA-Bench 考「会不会规划」,MobileWorld 考云手机里的跨应用执行,MobileWorld-Real 把评测带到 104 个真实 App 上,MobileWorld-Safety 专门考风险场景下的安全行动。行业里手机场景的系统化评测确实缺,这套东西比单个 Agent 的数字更值得关注。
来源: