回到时间线

7月21日周二23:55Model/API模型发布API 与价格中国模型模型发布指南

阿里 Qwen-Image-3.0 发布:支持 4500 Token 提示、10 像素可读文字与 12 种语言

决策简报

Brief
发生了什么
阿里通义千问团队推出 Qwen-Image-3.0,支持长达 4500 Token 的提示词、可生成 10 像素可读文字并原生支持 12 种语言,能一次生成包含多图、公式、界面嵌套的复杂信息图。
为什么重要
GPT 相关结果会影响评测基准、技术路线和后续产品判断。
影响谁
GPT · Qwen
建议动作
升级或复核变更版本
地区可用性
暂未验证地区可用性差异。

关键事实

  • 阿里通义千问团队推出 Qwen-Image-3.0,支持长达 4500 Token 的提示词、可生成 10 像素可读文字并原生支持 12 种语言,能一次生成包含多图、公式、界面嵌套的复杂信息图。 [src-decoder]
  • 该模型在文本渲染和长提示词合成方面有质的提升,做信息图、论文排版或广告设计的团队可以一次出图,不再依赖后期拼接。 [src-decoder]
高信心100% 主张有证据

由事件证据自动生成。

Qwen-Image-3.0 是阿里通义千问团队发布的第三代图像生成模型。它接受最长 4500 Token 的提示词,可一次生成包含多面板信息图、嵌套界面(如 VSCode 中打开 Qwen Chat,再内嵌微信对话和咖啡海报)的复杂内容。模型能渲染小至 10 像素的可读文字,支持日语、韩语、西班牙语等 12 种语言,并可处理多行 LaTeX 公式。此外,它还能生成带毛孔和发丝细节的人像,以及修复中国传统水墨画中的缺失部分。 目前 Qwen-Image-3.0 仅通过邀请制 API 提供,后续将集成到 Qwen Chat 等第一方应用中。与初代 Qwen-Image 不同,本代模型大概率不会开源权重。对需要频繁制作信息图、论文封面或界面 Mockup 的设计和内容团队而言,该模型能大幅减少多图拼接和后处理的工作量,但若需要可编辑格式(如 SVG),仍需考虑输出为像素图的局限性。

摘要依据:已读全文详摘依据上方标注的来源范围整理,内容以原文为准。

来源

相关情报

留言

登入后即可留言,和其他 builder 交换实测心得。

还没有留言,抢头香。