產品發佈
Qwen 發布 Qwen-Image-2.1-Turbo 加速版影像生成模型
Qwen/Qwen-Image-2.1-Turbo

huggingface.co · 2026-10-09
摘要
Qwen 團隊推出 Qwen-Image-2.1-Turbo,這是 Qwen-Image-2.1 的加速版本,專為文字轉影像生成與影像編輯設計。該模型僅需 8 個去噪步驟即可運作,並預設使用 CFG=1 與 KV 快取技術,開發者可透過 Diffusers 直接載入使用,無需手動調整排程器設定。
Qwen 推出加速版影像生成模型 Qwen-Image-2.1-Turbo
Qwen 團隊發布了 Qwen-Image-2.1-Turbo,這是 Qwen-Image-2.1 的加速版本,主要針對文字轉影像生成與影像編輯任務優化。模型沿用相同的 7B 視覺生成架構,使用 8 步去噪。開發者可以透過 Diffusers 套件直接載入權重,不必手動調整排程器設定就能使用。
核心技術與預設參數
Qwen-Image-2.1-Turbo 運作時預設使用 CFG=1,並採用前綴 KV 快取。這項技術會在去噪步驟之間重複使用文字與參考影像的上下文資訊。模型檢查點內建推薦的採樣排程,使用者載入模型後,系統會自動套用,不需額外配置。開發者若想實驗,可以在呼叫時明確指定 sigmas 參數來覆蓋預設排程,不過其他排程方案尚未針對這個檢查點進行評估。
安裝與使用方式
要使用這個模型,開發者需要安裝支援 CUDA 的 PyTorch 版本,再用 pip 安裝最新的 Diffusers 原始碼與相關依賴套件,包括 transformers(版本需大於等於 5.17.0)、accelerate 與 pillow。要注意的是,這個檢查點需要 Diffusers 支援管線配置的採樣 sigmas,該功能已在 PR #14950 中加入。
在文字轉影像的應用範例中,程式碼示範了如何從 Hugging Face 載入模型,並將資料類型設為 torch.bfloat16、裝置設為 cuda。範例中的提示詞描述一張垂直方向的化學學習海報,內容包含詳細的排版、顏色與科學符號描述。範例生成的影像解析度為 1680 × 2512,屬於直向比例。
影像編輯與支援解析度
除了文字生成影像,模型也支援影像編輯。開發者可以重複使用相同的管線,把輸入的機動遊艇草圖轉成寫實照片。編輯提示詞詳細描述了船隻結構、顏色配置、海面環境與光影效果。這個編輯範例使用的解析度為 2048 × 2048,屬於正方形比例。
Qwen-Image-2.1-Turbo 支援與 Qwen-Image-2.1 相同的解析度預設值,涵蓋多種長寬比,具體包括:1:1 為 2048 × 2048;4:3 為 2400 × 1792;3:4 為 1792 × 2400;3:2 為 2528 × 1696;2:3 為 1696 × 2528;16:9 為 2752 × 1536;9:16 為 1536 × 2752。
展示案例與授權資訊
官方展示了這個模型在 8 步輸出下的多種應用成果,類別包括人像攝影、人體姿勢與動態、透明影像生成、排版與海報設計、UI 與資訊佈局、單張影像轉換、多參考影像組合,以及四張影像的室內組合。每個類別各有一個範例,其中單張影像轉換、多參考影像組合與四張影像的室內組合附有輸入與輸出。
模型採用 Qwen Research License Agreement 授權條款。該模型在 Hugging Face 上上個月的下載次數為 2,138 次,有 10 個 Spaces 使用它。使用者若遇到問題,可以透過官方回饋表單直接聯繫 Qwen Image 研究團隊,提供提示詞、影像或工作流程,協助調查與改進。
●開發者:可透過 Diffusers 快速部署高效能影像生成模型
●投資人:Qwen 持續優化開源模型效能,強化生態系競爭力
●一般用戶:未來可能體驗到更快速的 AI 影像生成服務
重要性評分
🟠 值得關注
喜歡這篇?每天早晨還有更多。
訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。
相關指南

2026 免費 AI 工具完整清單:20 款不用付費的 AI 工具推薦
不想付費但想用好的 AI 工具?本文整理 2026 年 20 款免費 AI 工具,涵蓋聊天助理、圖片生成、語音克隆、程式助理,每款都說明免費版能用哪些功能、有沒有每日限額。
閱讀指南 →
Qwen vs Kimi vs DeepSeek 2026 比較:亞洲主流模型功能與定價分析
深入分析 2026 年 Qwen vs Kimi vs DeepSeek 三大亞洲主流模型。涵蓋功能對比、長文本處理、定價方案及實戰教學,助您選擇最適合的 AI 工具。
閱讀指南 →
Laya 開源決策模型中文實測:零樣本 53 題判斷題結果
Laya 是 Apache 2.0 的開源決策模型,不生成文字、只做選擇題。我們用 53 題中文長文判斷題零樣本實測,記錄結果、設定陷阱與使用建議。
閱讀指南 →🤖 本文摘要由 AI 自動生成,內容源自原始報導。如有疑慮,請參閱關於我們。
喜歡這篇?每天早晨還有更多。
訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。