一句话丢进去,3秒后一张能直接用的图出来。这是Qwen Intelligence这次发布的移动端创意智能体给出的成绩,官方说法是比同类领先产品快约2倍。

9月23日,Qwen Intelligence正式发布,定位是把个人智能带到每个人触手可及的地方。首发阵容是三款智能体,官方都标注为SOTA级别,分别管规划、执行和创作。

打开网易新闻 查看精彩图片

三款智能体,各管一段

第一款是Mobile Planner Agent,负责规划、拆解并编排复杂任务。它在MobilePA-Bench、MobilePA-Bench Business和Memory三项评测上都拿到第一。

第二款是Mobile-Use Agent,负责把事真正做完,走的是API优先、GUI兜底的路线。它的成绩单是:MobileWorld 82.1,MobileWorld-Real 92.2,AndroidDaily 97.2,端到端成功率90%。

第三款是Mobile Creative Agent,把一句话变成可以直接使用的创作成品。官方给出的数据是图像生成耗时3秒,比领先的同类产品快约2倍。

基准套件也一起开放

除了三款智能体,这次还开放了基准套件,包含MobilePA-Bench、MobileWorld、MobileWorld-Real和MobileWorld-Safety四项,覆盖规划、跨应用执行、真机性能和安全四个维度。

从评测覆盖的范围看,规划能力、跨应用执行、真机表现、安全,正好对应移动端智能体落地时最容易被追问的几件事。开放基准套件,等于把这几个维度的尺子也交了出来。

入口和资料都摆出来了

官方给出了完整的入口清单:

  • Qwen Intelligence官网:qwenintelligence.com
  • Mobile Planner Agent:github.com/Tongyi-MAI/Qwe…
  • Mobile-Use Agent:tongyi-mai.github.io/Qwen-UI-Agent/
  • Mobile Creative Agent:arxiv.org/abs/2608.16887
  • MobilePA-Bench:tongyi-mai.github.io/MobilePA-Bench/
  • MobileWorld(GitHub):github.com/Tongyi-MAI/Mob…
  • 排行榜:tongyi-mai.github.io/MobileWorld/#l…

三款智能体分工明确:一个负责想清楚怎么做,一个负责动手做完,一个负责把想法变成成品。规划、执行、创作这条链路,正好是移动端智能体从"能聊"走到"能用"要跨过的三段。

官方把这次发布定义为让个人智能触手可及。从给出的数字看,端到端成功率90%、真机评测92.2、图像生成3秒,这些指标指向的都是同一个方向:能不能在手机上真正把事办成。