Qwen-Image-3.0 发布:追求实用的图像生成
Qwen-Image-3.0 发布:追求实用的图像生成
QwenTeam 发布 Qwen-Image 系列第三代图像生成基础模型 Qwen-Image-3.0,核心定位用一个字概括:实。
这个"实"体现在三个维度:内容丰实、细节真实、知识厚实。
内容丰实:4.5k token 输入,九宫格一次生成
Qwen-Image-3.0 将可接受的指令长度提升至 4.5k token,这意味着模型可以理解和渲染极其复杂、信息密集的视觉版面。
官方展示了一张九宫格信息图,包含隧道安全漫画、空间几何教学、出师表文体分析、物理抛体运动、生物寄生虫科普、右胸疼痛医学图解、群论 Sylow 定理、银行内控管理信息图、细胞 DNA 结构对比,共九个独立信息板块,一次性生成而非拼接。完整描述这张图需要 3.7k token,而模型最大支持 4.5k token,仍有余量。

除了"横展"能力(多种概念在画面中有序布局),模型还具备"纵深"能力(语义解构与逻辑嵌套)。一条指令可以生成画中画中画的效果:VSCode 编程界面 → 千问聊天界面 → 微信聊天界面 → 手冲咖啡海报,每一层保持各自 UI 的真实风格与细节。

细节真实:10px 小字清晰可辨
在微观细节的渲染精度上,Qwen-Image-3.0 达到新的高度:10px 小字清晰可辨,毛孔与发丝纤毫毕现,肌肤质感逼近摄影级真实。
小字渲染方面,模型能够完整渲染一整页代数几何领域的学术论文,包含多行复杂公式推导。上标、下标、花括号、分数线、多行对齐等 LaTeX 排版元素均准确呈现。

模型还能生成真实报纸版面,密集文字配合报纸印刷质感;在编辑任务中可叠加逼真的手写批注——下划线、波浪线、圈画、箭头和简短评语,字迹自然流畅。
纹理刻画方面,人像摄影中的发丝、毛孔、肌肤纹理均能细腻还原。模型还能修复破损的传统绘画,保持原有艺术风格和笔触。

知识厚实:12 国语言 + 联网能力
Qwen-Image-3.0 拥有覆盖 12 国语言、多种字体、100+ 艺术风格和多种 UI 界面的渲染能力。模型能准确渲染日文、韩语、西班牙语等多语言内容,能仿真主流网页、游戏、直播等 UI 界面。

模型还支持联网获取最新知识。官方演示了生成杭州当天的天气预报图,以及找到特定 IP 形象进行创作(如齐白石和梵高在直播间介绍 Qwen-Image-3.0)。
总结
从 1.0 的"准",到 2.0 的"准多齐美真",再到 3.0 的"实",Qwen-Image 的迭代方向一直很明确:追求实用性和好用度。4.5k token 的长指令支持、10px 小字的精准渲染、12 国语言的原生理解和联网能力,让模型在报纸排版、短剧分镜、学术配图、UI 原型等高价值场景中具备了真正的落地能力。
目前 Qwen-Image-3.0 可通过 Qwen Chat 免费体验。
- 美国政府要求 OpenAI 分阶段发布 GPT-5.66/26/2026
- Anthropic 获美国政府批准,恢复 Mythos 5 模型对关键基础设施组织的部署6/27/2026
- 腾讯玄武阿图因AI在CyberGym测试中超越Mythos7/3/2026
- 华为开源 920 亿参数 openPangu-2.0-Flash 模型6/30/2026
- Gemini Omni Flash 登顶 Video Arena 盲测榜,领先第二名 101 分7/3/2026
- DeepSeek 联合北大开源 DSpark:半自回归推测解码,推理速度提升 57% 至 85%6/27/2026
- Claude Code 被指通过 system prompt 隐蔽传递代理与时区信息6/30/2026
- Cursor 研究:越强的 AI 模型越会"作弊"应对编程基准测试6/26/2026
- 苹果首款触屏 MacBook 确认搭载 M5 Pro/Max,M7 版计划 2027 年跟进6/27/2026
- Voicebox:43K Stars 的开源 AI 语音工作室,7 引擎 TTS + MCP Agent 集成7/19/2026
- Hallmark:一份写给AI编码助手的反AI味设计手册7/17/2026
- OmniRoute:日增 1300+ Star 的开源 AI 网关,一个端点接通 250 个模型提供商7/20/2026
- 华为天才少年的开源AI Agent全书:6700星、十章、可跑实验代码7/20/2026
- AI 代码审查的 token 困境:code-review-graph 如何用代码图谱砍掉 98% 的上下文7/20/2026
- Kimi K3:2.8万亿参数开源模型,前端编程Arena登顶7/17/2026
- B站在WAIC展出开源AI猫娘:能看懂屏幕、主动搭话的桌面伙伴7/18/2026
- Kimi K3 首登 DeepSWE v1.1:开源权重模型挤进前三7/18/2026
- KTransformers:单 GPU 跑 671B MoE 模型的清华方案7/21/2026
- 27B 模型塞进手机:PrismML Bonsai 27B 把权重压到 1-bit7/18/2026
- AI 连破三大数学猜想:Jacobian 猜想 87 年反例与形式化验证的新时代7/21/2026
- Qwen3.8 发布:2.4T 参数、原生多模态、开放权重承诺7/19/2026
- 2026 年 AI 都学会了记忆,但你的记忆不属于你7/19/2026
- 马斯克:AI 和机器人将让工作变为可选,实现全民高收入7/3/2026
- GPT-5.6用一段十页提示词,关闭凸优化30年的复杂性缺口7/19/2026
- Moonshine Micro:80美分芯片跑完整语音流水线,500KB内存装下VAD+STT+TTS7/18/2026
- LingBot-Map:用前馈3D基础模型做流式重建,20FPS跑完一万帧7/18/2026
- 香港处理中国过半芯片进口创历史新高:AI贸易重塑亚洲供应链7/5/2026
- 从老鼠视皮层还原10秒视频:大脑视觉编码研究的里程碑7/13/2026
- Meta大脑读心术:非侵入式脑机接口解码句子准确率创新高7/11/2026
- GPT-5.6一小时解开50年数学猜想:循环双覆盖猜想的证明路径与Prompt拆解7/12/2026