据千问大模型消息,阿里巴巴(BABA)正式推出Qwen-Image系列第三代图像生成基础模型Qwen-Image-3.0,其核心主线为“实”,具体体现在内容丰实、细节真实、知识厚实三个维度,旨在让图像生成成为真正可落地的生产力工具。目前,阿里云百炼、千问AI平台已开通API邀测。
内容丰实方面,模型支持最大4.5k token输入,具备强大的横展与纵深能力。它能一次性生成包含数学PPT、物理抛体运动、群论Sylow定理等九个复杂信息图的九宫格,完整描述需3.7k个token。同时,模型还能通过一条指令,在一幅图中渲染出从VSCode编程界面到手冲咖啡海报等多层嵌套的“画中画”界面。
细节真实方面,模型实现了10px小字精准渲染,可清晰呈现学术论文中的复杂公式推导,并逼真模拟手写笔记批注。在人像摄影中,毛孔、发丝等微观细节纤毫毕现。此外,模型还能以与原画一致的笔法完成古画修复,去除霉斑和破损痕迹,保持原有艺术风格。
知识厚实方面,Qwen-Image-3.0支持12国语言原生渲染,可生成西班牙语等多语言内容,并具备仿真UI界面和复杂信息图生成能力。例如,它能基于真实昆虫照片,添加分类学信息、形态标注和比例尺等专业元素,直接生成可用于学术发表的研究配图。
原文:Qwen-Image-3.0:落字成画,字字如印(来源:千问大模型)
