跳到正文

千问 APP 实测:从王者战绩图到拼豆图纸,一个 All in One 入口的 C 端想象力

讲师 一泽 · 20:00 直播

2025 年 11 月 18 日,WaytoAGI 社区「晚八点共学」邀请 AI 产品经理一泽(Eze)与众测团成员考拉,围绕阿里新上线的千问 APP 展开了一场实测分享。这场分享适合所有对国产大模型 C 端应用感兴趣、想了解千问 APP 实际能力边界的用户,尤其是那些不满足于「聊天问答」,希望用 AI 解决具体生活场景问题的人。一泽从游戏战绩图美化、拼豆图纸生成、博物馆导览到录音纪要,展示了千问 APP 在生产力之外的「情绪价值」潜力;考拉则通过对比测试,验证了千问在文本回答上的独特风格。

千问 APP 的定位:All in One 的移动端入口

许键在开场分享了自己对千问模型的长期观察。他提到,自己长期从事 to B 场景工作,并基于千问模型进行微调尝试,原因是「千问的模型是整体上咱们全国综合性最强的就是最聪明的一类模型」。他特别指出,千问的回答虽然「有点偏中规中矩」,但在开启思维模式或处理复杂题目时,「确实比其他模型回答得要好,虽然不一定会特别拟人,但是一定答案是更偏向于标准和准确的,然后幻觉也没那么高」。

许键认为,千问 APP 的意义在于将 AI 从电脑端带到了手机端。他回忆了 2023 年初与 AG 在杭州法喜寺线下活动时的场景:AG 现场拿着手机,看到古代建筑和文字就直接用 AI 拍摄识别并获取解释。「在手机上来用这样的一个 AI 一定是比电脑上方便的,因为手机你们都随身携带的,然后随时拍、随时问、随时想,就能改变我们很多的一些日常的一些习惯。」

一泽则从产品形态角度补充了对千问 APP 的观察。他认为千问对标 GPT-5 的智能路由思路,背后是庞大的 Qwen 模型家族(包括 Coder、Max、Image 等),且这些模型在全球范围内开源,在各大榜单上表现优异。为了提供更好的 C 端服务,千问在手机端取消了模型选择功能,界面只有一个简洁的输入框,用户可按需打开深度思考、修图、翻译等功能。「整体就看上去就非常的简洁,然后有点不像是阿里系会做出来的产品」,一泽这样评价。

游戏战绩图:让胜利的分享更有仪式感

一泽分享的第一个案例来自小红书上的热门玩法——用 AI 重绘王者荣耀结算画面。他发现大量玩家在游戏胜利后,希望将结算画面分享到朋友圈,但默认画面缺乏个性。「在一个玩家都愿意为自己的本命英雄斥资 168 甚至更贵去抽卡的时候,那谁不会想一个更加个性化的一个结算的一个战绩图。」

他现场演示了完整操作流程:在千问 APP 中点击「AI 修图」功能(或不点击,直接上传图片,模型会自动识别修图任务并调用 Qwen-Image 模型),输入社区开源的提示词,即可生成重绘后的战绩图。他展示的效果图中,英雄被重新绘制为坐在椅子上的姿势,画面更具冲击力。一泽强调,用户可以在基础提示词上做更多定制,比如改变鞋子款式、调整拍摄视角等,「她穿的不是高跟鞋,她穿的是一双拖人字拖」,「她也可以是一个从头往下的自拍视角」。

考拉也分享了自己的实测体验。她最初完全照搬一泽分享的提示词,发现生成结果风格同质化严重,于是将提示词交给 DeepSeek 修改,要求「换一个姿势去掉这个王座,然后手拿那个冠军奖杯」,最终得到了满意的效果——英雄以胜利者姿态手持奖杯,情绪到位。

图片编辑的隐藏强项:拼豆图纸与杯贴素材

一泽接着分享了两个更贴近日常生活的图片编辑场景。第一个是喜茶杯贴素材制作:用户可以将喜欢的角色图片转换为线稿图,再上传到喜茶小程序进行创意打印。他演示了将一张彩色角色图转换为线稿图的效果,「笔触稍微没有那么的粗放以外,实际上整一个原图的一个保持是非常好的」。

第二个场景是拼豆图纸生成。拼豆是一种将图像像素化后,用彩色塑料颗粒逐颗拼装的手工玩法,通常需要一张标明每个格子颜色和位置的图纸。一泽测试了将一张「小八」图片转换为拼豆图纸,结果令他惊讶:「它给出来的这一个方框基本上都是正的,也没有线条的丢失」。他特别指出,此前测试 Nano Banana 等其他模型时,经常出现格子变形、线条丢失,甚至「一个格子里面还会有两种颜色」的问题,导致图纸不可用。而 Qwen-Image 在这个任务上「莫名其妙的就非常的强」。

音视频能力:博物馆导览、录音纪要与会话翻译

一泽分享了自己此前用 ChatGPT 视频通话逛博物馆的习惯——对着展品提问,让 AI 实时介绍。千问 APP 上线后,国内 Qwen 音视频通话模型也随之登陆移动端。他演示了视频通话功能:在通话过程中,系统会自动将双方语音以字幕形式展示。他通过播放太和殿视频进行测试,让 AI 介绍太和殿历史,并模拟了在博物馆中询问文物背景的对话场景。

他还提到小红书上的实用玩法:在国外餐厅用视频通话对着外文菜单,让 AI 推荐适合自己口味的菜品,甚至帮忙生成点菜用语。

录音纪要是他评价最高的功能。一泽回忆,通义听物在飞书等产品尚未推出 AI 会议纪要时就已存在,且效果出色。千问 APP 延续了这一优势,支持中英日、粤语等多语言,既能用手机麦克风收音,也能直接录制手机内音频。他演示了录制老罗播客的效果:系统能区分发言人,并生成原文导读和脑图。「你打开你的小宇宙,打开 Youtube,打开哔哩哔哩,然后在看的时候……你也是甚至也是能够打开着这个手机的一个录制的一个功能,然后全程录制,然后你人在一边先随便听一听,然后最后面会议纪要就出来了。」

他还提到小红书上的有趣用法:情侣吵架时开着录音纪要功能,事后复盘「中间说错的话是什么」;游戏玩家用腾讯会议录制游戏讨论,复盘策略失误。

虚拟陪伴与情绪价值

一泽观察到,AI 虚拟陪伴是一个「圈子虽小但人数不少」的领域。他提到,早在 4 月份测试第一版 Qwen 3 时,就发现其在拟人化对话风格上表现出色。他给出了评估 AI 拟人化回应质量的参考维度:人设一致性、个性化回应、情绪感知、交互质量与自然度、智力和洞察启发,以及主动陪伴感。

在千问 APP 中,他设置了 AI 人设信息后进行测试,效果「蛮不错的」——模型能自然融入上下文,知道当前时间,甚至能调用工具查询天气。他总结道,除了让工作更高效,AI 的价值也在于「让一场游戏胜利结算画面更加有仪式感,去更加开心地去做一些自己的定制,然后去深度了解博物馆的每一件产品」,满足用户的表达欲、求知欲和陪伴感。

现场问答

通义和千问是什么关系? 一泽解释:如果指 APP 或 Web 端的统一 chatbot 产品,千问是在通义基础上升级重构而来;如果指模型,标准学名是「千问大模型」或「Qwen 英文大模型」。

电脑端创建的智能体,手机端支持显示吗? 一泽确认理论支持,但当前版本功能尚未完全同步,手机端更新更及时。

千问的画图效果与其他模型(如即梦、豆包)相比如何? 一泽认为风格上有差异,但不同任务各有优劣。「各家其实训练的一个数据集是不一样的,它最后出来的一个效果或者是擅长的一些点都会有些偏差。」他以拼豆图纸为例,千问表现格外好,但其他任务未必压倒性胜出。

千问支持录音实时转文字吗?录音存储在哪里? 实时转文字功能暂不支持。录音存储位置不确定,需咨询官方。

千问支持生成音频或视频吗?播客功能上线了吗? 一泽最初表示生成音频和视频功能暂未上线,随后更正:播客功能已上线,但生成视频功能尚未开放。

PC 端和手机端有什么区别? 一泽表示 PC 端功能更丰富,但两端迭代尚未完全同步,目前手机端更新,「他这次主打就是手机端的一个功能体验,所以优先在手机上使用会更好一些」。

打开千问实时录音,为什么无法记录会议内容? 一泽确认当前版本不支持直接录制飞书等会议软件的声音。问题饼老师补充了替代方案:将千问作为插件嵌入网页版飞书或 Teams 使用,可实现翻译和字幕功能;最保险的方式是「把这个会议全部录音或者录屏,然后再丢给他做音视频解读」。

现场测试:生成物理实验教学图 应观众要求,一泽现场用千问生成了一个演示光的折射的 HTML 教学页面。页面支持切换介质和调整参数,手机端可直接预览。许键指出图中反射部分存在物理逻辑错误,但整体可修改使用。

要点回顾

  • 千问 APP 是阿里将通义升级重构后的统一 C 端入口,界面简洁,无模型选择,按需调用深度思考、修图、翻译等功能。
  • 游戏战绩图重绘:上传结算画面,输入开源提示词即可生成个性化战绩图,可定制姿势、视角、服饰等细节。
  • 拼豆图纸生成是 Qwen-Image 的强项,格子规整、线条不丢失,优于 Nano Banana 等模型。
  • 音视频通话支持实时字幕,可用于博物馆导览、外文菜单识别等场景。
  • 录音纪要支持中英日、粤语,可内录手机音频,自动区分发言人并生成导读和脑图。
  • 虚拟陪伴场景中,千问的拟人化回应质量较高,可从人设一致性、情绪感知等维度评估。
  • 千问 APP 目前不支持生成音频和视频,播客功能已上线;PC 端与手机端功能尚未完全同步。
  • 众测活动:下载千问 APP,按教程定制战绩图,在小红书发布并带 #千问 话题,填写问卷即可参与。

直播回放58 分钟

播放器来自飞书妙记 · 在新窗口打开