一个客户端搞定四种内容创作
2026年8月14日,千问办公客户端正式上线多模态智能生成能力。用户可以在一个平台内一站式完成文字、图片、音乐、视频四类内容的创作,同时打通了企业IM与网页部署功能,覆盖营销海报、产品视频等多元办公场景的物料需求。
这意味着,过去需要在多个工具之间来回切换的工作流——用文案工具写文案、用设计工具做海报、用音频工具配乐、用视频工具剪辑——现在可以在千问办公一个客户端内完成。对于需要频繁产出营销物料的团队来说,这直接缩短了从创意到成品的链路。

多模态能力的实际应用场景
多模态生成的价值在于”一站式”而非”单点突破”。以新品发布为例,市场团队可以在千问办公中先用文字生成产品文案,再用图片功能生成营销海报,配合音乐功能制作背景音,最后用视频功能合成产品展示视频。整个过程不需要切换工具,所有素材集中管理,也便于团队协作和版本迭代。
更重要的是,这些能力打通了企业IM部署。生成的物料可以直接通过企业微信或钉钉分发,网页端也能同步展示。对于需要快速响应市场变化的运营团队,这种从创作到分发的闭环能显著提升效率。
底层模型支撑:Qwen3.8多模态
多模态生成能力的底层支撑来自千问团队此前开源的Qwen3.8系列模型。8月14日晚,千问宣布正式开源Qwen3.8-27B原生多模态稠密模型,采用Apache 2.0协议,270亿参数,支持262K原生上下文并可外推至1M Tokens。该模型在Agentic terminal coding测试中得分73.0,量化后可在消费级显卡上运行。
截至目前,千问累计开源460余个模型,全球下载超30亿次,衍生模型超30万个。这种开源策略不仅推动了技术普及,也为千问办公的智能体能力提供了坚实的底层支撑。
从文字工具到创作平台
千问办公此次上线多模态能力,标志着产品定位从”AI文字助手”向”AI创作平台”升级。此前千问办公已支持桌面端Agent、云端Agent和企业协同Agent三种模式,多模态生成能力的加入让这些Agent能产出的内容类型大幅扩展。
对于日常办公用户来说,最直接的变化是:做PPT配图不用再找素材网站了,做短视频不用再开剪辑软件了,写方案配音乐也不用单独找音频工具了。一个客户端,四种创作能力,这就是多模态给办公场景带来的实际便利。