阿里巴巴的Qwen团队于周二推出了Qwen Image 3.0,其投稿与输出的外观有多漂亮无关。这是关于输出是否可以真正在工作中使用的问题。
大多数人工智能图像工具——Reve、Nano Banana、Seedream——都是为了在特定领域表现出色而设计的:创造力、真实感、编辑能力等等。 Qwen Image 3.0 正在走向不同的方向。 “Qwen-Image-3.0不只是追求‘好看’,而是追求‘有用’,让图像生成成为真正可部署的生产力工具。”Qwen团队在官方公告中写道。

核心内容是中国巨头阿里巴巴所说的丰富内容。该模型最多可接受 4,500 个代币,是上一代处理能力的 4.5 倍。令牌是人工智能读取的文本单位;将令牌大致想象为一个单词或单词的一部分,因此其中 4,500 个是几页详细说明
这足以在一个提示中描述九个独立的信息图表面板,并将它们作为一个完整的图像返回。
阿里巴巴在其博客中写道:“上面的整个图像是由 Qwen-Image-3.0 单次生成的,而不是由多个图像拼接在一起。”演示中的每个面板都包含自己的图表、公式、标题和精美的文本——一次性渲染,而不是在后期组装。
这是唯一能够实现这一目标且没有重大错误的模型。
第二部分是该公司所说的真实细节。据阿里巴巴介绍,该模型“支持小至 10 像素的文本精确渲染,以逼真的微观层面描绘,生动地再现毛孔、发丝等细节。”十个像素是细则——您会在药品