阿里巴巴推出了竞争对手Nano Banana——基于人工智能的强大图像生成器Qwen-Image-2.0。

阿里巴巴推出了竞争对手Nano Banana——基于人工智能的强大图像生成器Qwen-Image-2.0。

32 software

阿里巴巴推出新一代图像生成模型——Qwen‑Image‑2.0

阿里巴巴公司发布了其最新的人工智能研发成果 Qwen‑Image‑2.0,旨在用于创建和编辑图形内容。该模型展示了多项关键优势,使其在 AI 市场中具有竞争力。

Qwen‑Image‑2.0 能做什么
功能 | 说明
---|---
精准文本再现 | 生成的图像包含无误的文字,并可选择书写风格。
支持长请求 | 模型处理多达 1000 个 token,支持复杂构图和详细指令。
多样化输出格式 | 从照片级真实感图片、演示幻灯片到海报和漫画等。
美学与构图 | 能够和谐排版文字,选择字体样式并对齐画面中的对象。

举例:在生成光滑木板的图像时,模型能准确反映周围物体,并无损失地集成文字。

模型由来
Qwen‑Image‑2.0 结合了阿里巴巴两大研究方向:

1. 图像生成——最大精度与细节化,包括文本的正确呈现。
2. 图像编辑——保持原始内容不失真,功能完整且一致性高。

这两种方法的融合产生了一款通用模型,其架构更简洁:体积更小,但生成速度更快。

相较竞争对手的优势

- 精度 —— 继承了以往版本在图像编辑方面的专业技能。
- 请求灵活性 —— 支持多达 1000 token,能设置复杂场景与构图。
- 美学 —— 自动排版文字并根据图像上下文选择合适字体。
- 构图 —— 元素对齐可生成信息丰富的漫画和电影海报。

AI Arena 测试
阿里巴巴对 Qwen‑Image‑2.0 与行业领先模型进行了盲测:

任务最佳竞争者结果
图像生成Google Gemini‑3‑Pro‑Image‑Preview, OpenAI GPT Image 1.5-
图像编辑仅 Google Gemini 超越 Qwen‑Image‑2.0-

因此,在大多数场景中,Qwen‑Image‑2.0 在中国及国际模型中表现出领先指标。

结论
阿里巴巴推出了一款强大、灵活且美学平衡的图像生成模型,能够满足设计专业人士和寻求快速视觉内容创作方案的用户需求。

评论 (0)

分享你的想法——请保持礼貌并围绕主题。

暂无评论。留下评论,分享你的观点!

要发表评论,请先登录。

登录后发表评论