阿里 Qwen-Image-3.0 发布:支持 4500 Token 提示、10 像素可读文字与 12 种语言
决策简报
Brief- 发生了什么
- 阿里通义千问团队推出 Qwen-Image-3.0,支持长达 4500 Token 的提示词、可生成 10 像素可读文字并原生支持 12 种语言,能一次生成包含多图、公式、界面嵌套的复杂信息图。
- 为什么重要
- GPT 相关结果会影响评测基准、技术路线和后续产品判断。
- 影响谁
- GPT · Qwen
- 建议动作
- 升级或复核变更版本
- 地区可用性
- 暂未验证地区可用性差异。
关键事实
- 阿里通义千问团队推出 Qwen-Image-3.0,支持长达 4500 Token 的提示词、可生成 10 像素可读文字并原生支持 12 种语言,能一次生成包含多图、公式、界面嵌套的复杂信息图。 [src-decoder]
- 该模型在文本渲染和长提示词合成方面有质的提升,做信息图、论文排版或广告设计的团队可以一次出图,不再依赖后期拼接。 [src-decoder]
由事件证据自动生成。
Qwen-Image-3.0 是阿里通义千问团队发布的第三代图像生成模型。它接受最长 4500 Token 的提示词,可一次生成包含多面板信息图、嵌套界面(如 VSCode 中打开 Qwen Chat,再内嵌微信对话和咖啡海报)的复杂内容。模型能渲染小至 10 像素的可读文字,支持日语、韩语、西班牙语等 12 种语言,并可处理多行 LaTeX 公式。此外,它还能生成带毛孔和发丝细节的人像,以及修复中国传统水墨画中的缺失部分。 目前 Qwen-Image-3.0 仅通过邀请制 API 提供,后续将集成到 Qwen Chat 等第一方应用中。与初代 Qwen-Image 不同,本代模型大概率不会开源权重。对需要频繁制作信息图、论文封面或界面 Mockup 的设计和内容团队而言,该模型能大幅减少多图拼接和后处理的工作量,但若需要可编辑格式(如 SVG),仍需考虑输出为像素图的局限性。
摘要依据:已读全文详摘依据上方标注的来源范围整理,内容以原文为准。
来源
- The Decoder:AI News
- The Decoder:AI News
留言
登入后即可留言,和其他 builder 交换实测心得。
还没有留言,抢头香。