跳到正文
FunCoding

搜索

搜索文档、文章、Skill 和 MCP

返回 AI 热点

Qwen 开源 Qwen-Image-2.1 并推出 Turbo 加速版

持续报道中U9 个来源18 篇报道更新于 2026年10月10日 04:33

事件综述

阿里通义千问团队开源 Qwen-Image-2.1,把文生图与图像编辑合并到同一个 7B 视觉生成模型中,并原生支持生成和编辑带 alpha 通道的 RGBA 透明图像。模型支持最多 10 张参考图、圆形/涂鸦/掩码等局部编辑,官方称通过混合粒度注意力与 KV cache 复用提升推理效率,并改进了文字渲染与人像光照。权重已在 GitHub、HuggingFace、ModelScope 开放,但采用 Qwen Research License,商用需另行授权。

发布后 vLLM-Omni、SGLang-Diffusion、ComfyUI、diffusers 和 Intel OpenVINO 均提供首日支持,Unsloth 推出可在 12GB 显存本地运行的 GGUF 量化版。Arena 显示其 Image Edit Arena 得分 1367、开源第一、总榜第 16,Text-to-Image Arena 开源第一;Artificial Analysis 本地部署评测中,它在两个 AA-Image 榜单均列第 18、为开源权重模型第一。团队称其自建基准超过多数闭源模型,独立基准尚待验证。

10 月 9 日,通义千问又发布基于同一 7B 架构的加速版本 Qwen-Image-2.1-Turbo,将去噪步骤从 40 步缩减为 8 步,支持 2K 生成、多参考图编辑和透明 RGBA 输出,权重同样开放;该版本同样为研究许可,商用自托管需另行授权,API 在多数地区每张图 0.1 元、限速 120 RPM。

最新进展阿里千问发布 Qwen-Image-2.1-Turbo:7B 图像模型 8 步生成 2K 图像

综述由 AIHOT 用 AI 根据各家报道生成,细节以原文为准。

报道时间线

10月10日周六

  1. MarkTechPost

    阿里千问发布 Qwen-Image-2.1-Turbo:7B 图像模型 8 步生成 2K 图像

    阿里千问发布 Qwen-Image-2.1-Turbo,将 Qwen-Image-2.1 的 40 步去噪缩减为 8 步,保持 7B 架构,支持 2K 生成、多参考图编辑和透明 RGBA 输出,文本编码器为 Qwen3-VL 8B。

10月9日周五

  1. 通义千问 / Qwen

    通义千问发布 Qwen-Image-2.1-Turbo,8 步去噪即可生成和编辑图像并开放权重

    通义千问发布 Qwen-Image-2.1-Turbo,基于同一 7B 视觉生成架构的加速 checkpoint,只需 8 个去噪步骤即可生成和编辑图像,权重已开放。

10月5日周一

  1. MarkTechPost

    通义千问(Qwen)进化史:从 Qwen-7B 到 2.4T 参数的 Qwen3.8

    文章按时间线回顾了阿里 Qwen 从 2023 年 4 月通义千问邀测到 2026 年 Qwen3.8-2.4T-A95B(2.4 万亿参数、激活 95B)的完整发布历程。

10月2日周五

  1. Artificial Analysis

    Artificial Analysis 评测:Qwen-Image-2.1 登顶两个 AA-Image 榜单的开源权重模型

    Artificial Analysis 自行本地部署评测了阿里 9 月 20 日以开源权重发布的 Qwen-Image-2.1,该模型在 AA-Image-T2I v2.0 和 AA-Image-Editing v2.0 上均排名第 18,为两个榜单上排名第一的开源权重模型,超过 Ideogram 4.0(Quality)和 HunyuanImage 3.0 Instruct。

9月23日周三

  1. 通义千问 / Qwen

    Qwen-Image-2.1 登顶 Arena 图像编辑与文生图开源榜第一

    通义千问宣布 Qwen-Image-2.1 在 Arena 的 Image Edit Arena 和 Text-to-Image Arena 均为开源模型第一。引用内容显示其 Image Edit Arena 得分 1367,总榜第 16,距第 15 名 GPT-Image-1.5-high-fidelity 仅 3 分,官方邀请用户体验该模型。

  2. UUnsloth

    Unsloth 发布 Qwen-Image-2.1 GGUF 量化版,12GB 显存可本地运行

    Unsloth 发布 Qwen-Image-2.1 的 Dynamic GGUF 量化版本,让这个 7B 文生图加编辑模型可在 12GB 显存上本地运行,并称其表现与 Nano Banana 2.0 相当。

9月22日周二

  1. Arena

    Qwen-Image-2.1 开源发布,登顶 Arena 图像编辑榜开源第一

    通义千问发布 Qwen-Image-2.1,开放权重,在 Arena Image Edit Arena 以 1367 分位列开源第一、总榜第 16,距第 15 名 GPT-Image-1.5-high-fidelity 仅 3 分,同时登上 Text-to-Image Arena 开源第一。

  2. 通义千问 / Qwen

    Qwen-Image-2.1 获 OpenVINO Day-0 支持

    来自 @inteldevs 的 Day-0 OpenVINO 支持!🥳 Qwen-Image-2.1 已可在 Intel 硬件上优化运行。一个开放权重 checkpoint,同时支持生成和编辑。👇

  3. MarkTechPost

    阿里通义千问发布 Qwen-Image-2.1:7B 开源权重图像生成与编辑模型

    阿里 Qwen 团队发布 Qwen-Image-2.1,将文生图与图像编辑统一到一个 7B 单流 DiT 模型中,搭配 8B Qwen3-VL 编码器,支持原生 RGBA 透明输出和最多 10 张参考图编辑。

9月21日周一

  1. 通义千问 / Qwen

    SGLang-Diffusion Day-0 支持 Qwen-Image 2.1,支持文生图、多图编辑与透明 RGBA 输出

    SGLang-Diffusion 发布对 Qwen-Image 2.1 的 Day-0 支持,覆盖文本生成图像、多图编辑和透明 RGBA 输出,单 checkpoint 即可完成。

  2. 通义千问 / Qwen

    通义千问发布 Qwen-Image-2.1:7B 单检查点同时支持图像生成与编辑

    通义千问发布 Qwen-Image-2.1,一个 7B 参数的原生图像生成与编辑模型,生成和编辑共用单一检查点,最多支持 10 张参考图。模型自带提示词增强 LLM,已集成 diffusers 和 ComfyUI,并在 Hugging Face Spaces 提供免安装的浏览器在线 demo:https://huggingface.co/spaces/hugging-apps/qwen-image-2-1

  3. The Decoder:AI News

    阿里 Qwen 团队发布开源权重图像生成模型 Qwen-Image-2.1,仅 7B 参数

    阿里 Qwen 团队发布开源权重图像生成与编辑模型 Qwen-Image-2.1,视觉生成部分仅 7B 参数,团队称在其自建基准上超过多数闭源模型,独立基准尚待验证,可在 RTX 3090 等消费级 GPU 上运行。

9月20日周日

  1. 通义千问 / Qwen

    Qwen-Image-2.1 已支持 ComfyUI,开源权重开放下载

    Qwen 宣布 Qwen-Image-2.1 现已支持 ComfyUI,权重开放。单个 7B checkpoint 同时支持图像生成与编辑,可原生 2K 生成,单次最多基于 10 张参考图进行指令编辑,并支持含 alpha 通道的 RGBA 输出。

  2. 通义千问 / Qwen

    通义千问发布 Qwen-Image-2.1,vLLM-Omni 提供首日支持

    通义千问发布 Qwen-Image-2.1,vLLM-Omni 提供 day-0 支持。该模型可在一个模型内完成图像生成、编辑和透明图像输出,由 7.1B DiT 搭配 Qwen3-VL-8B 组成,设置和受支持的组合见 https://recipes.vllm.ai/Qwen/Qwen-Image-2.1。

  3. HHacker News:AI 热帖

    通义千问开源 Qwen-Image-2.1,统一图像生成与编辑并原生支持透明图像

    Qwen 团队开源 Qwen-Image-2.1 图像模型,将文生图与图像编辑统一在单一模型中,视觉生成组件仅 7B 参数,并原生支持生成和编辑透明图像。模型支持最多 10 张参考图、圆形/涂鸦/掩码指定局部编辑、人物与产品保真,并通过混合粒度注意力与 KV cache 复用提升推理效率,还改进了文字渲染与人像光照细节。

  4. 通义千问 / Qwen

    通义千问发布 Qwen-Image-2.1 并开放权重

    通义千问发布 Qwen-Image-2.1,定位为 Qwen-Image 系列中均衡且高性价比的图像生成模型,现已开放权重。该模型为生成与编辑一体化的 7B 轻量架构,原生支持生成和编辑 RGBA 透明图层,编辑支持最多 10 张参考图和精确局部控制,并擅长全景图、信息图和虚拟试穿等场景。

  5. IT之家·人工智能

    阿里千问开源 Qwen-Image-2.1 图像模型,支持透明图像与最多 10 张参考图

    阿里千问开源图像模型 Qwen-Image-2.1,将文生图与图像编辑整合在同一模型中,视觉生成部分仅 7B 参数,原生支持透明图像的生成与编辑。更新亮点包括轻量结构与推理优化、支持最多 10 张参考图的局部编辑与人像商品保真,以及文字排版和人物光影表现提升,模型已上架 GitHub、HuggingFace 和 ModelScope。

  6. QQwen:Blog Retrieval官方

    Qwen 开源 Qwen-Image-2.1:7B 统一生成与编辑并原生支持透明图像

    Qwen 团队开源 Qwen-Image-2.1,将文生图与图像编辑统一到一个模型中,视觉生成组件仅 7B 参数,并原生支持生成和编辑透明图像。模型支持最多 10 张参考图、圆形/涂鸦/独立蒙版指定局部编辑,通过混合粒度注意力架构和 KV cache 复用提升推理效率,同时改进文字渲染、人像光照与人物产品保真度,并覆盖全景图、信息图和分镜等任务。