阿里開源 Qwen-Image-2.1-Turbo:8 步去噪出圖與編輯
阿里發布 Qwen-Image-2.1-Turbo,這是基於 Qwen-Image-2.1 的加速 checkpoint,只需 8 步去噪即可生成和編輯影像,權重已在 ModelScope 與 Hugging Face 開放。它沿用同一 7B 視覺生成架構,官方稱步數減少不犧牲品質,仍可從文字生成 2K 影像,並支援用自然語言繼續編輯,例如新增配飾或更換場景。Diffusers 中載入 QwenImage21Pipeline 即可使用推薦的 8 步取樣;
把影像生成壓縮到 8 步並同時開放權重和託管 API,對在自有工作流裡跑影像模型或需要直接呼叫 API 的開發者都是可立即驗證的具體新選項。
原標題:@Alibaba_Qwen: 🚀 Meet Qwen-Image-2.1-Turbo — create and edit images in just 8 denoising steps!
閱讀原文
| 評分 | 80 / 78(平均 79,門檻 60) |
|---|---|
| 狀態 | 精選 |
相關報導
阿里 Qwen 官方帳號發圖,正文無文字說明
阿里 Qwen 官方 X 帳號在 2026 年 10 月 9 日發布動態,正文只有「Pics:」一詞,隨附圖片,沒有任何文字說明。公開可見的文字裡沒有出現模型名稱、版本號、功能或發布時間,因此無法確認圖片指向哪款產品或更新。要了解具體內容只能檢視原帖圖片,後續說明有待官方補充。
Google 發布 Nano Banana 2.1,底座換成 Gemini 3.6 Flash
Google DeepMind 正式發布 Nano Banana 2.1,底層由 Gemini 3.6 Flash 驅動,模型 ID 為 gemini-nano-banana-2.1,已作為穩定模型上線 Gemini App、AI Studio、Gemini API、Search AI Mode、Google Ads、Flow 與 Stitch。新版定位高效率影像生成與對話式編輯,支援 1K/2K/4K 輸出、最多 14 張參考圖融合,重點強化設計版式、蒙版區域性編輯和主體一致性;
用 ML Intern 幾天做出 6 個模型,9B 改寫器壓到 0.8B
Hugging Face 的 yuvraj sharma 用 HuggingChat 裡的 ML Intern agent,幾天內做出 6 個公開模型,其中把 Qwen-Image 2.1 自帶的 9B 提示改寫器蒸餾成 0.8B 版本,可在 CPU 執行,輸出有效率 99.7%,token 消耗約為教師模型的四分之一。該專案含 9B 模型標註 8,797 條樣本,算力成本 16 美元。
OpenAI 推出 Decisions API,llm 外掛已支援影像問答
OpenAI 發布新的 Decisions API,支援 yes/no、選項和打分三類問題,新模型 gpt-6-luna 相比 Jev 額外支援影像輸入。兩者都只對輸入計費:OpenAI 為 10 美分/百萬輸入 token,Jev 為 4.2 美分/百萬。
開源 Rembrandt 發布:本地 AI 修圖免費替代 Lightroom
免費開源的本地 AI 修圖工具 Rembrandt 發布,支援 macOS、Windows 與 Linux,無需帳號與訂閱。它把 2×/4× 超解析度、AI 降噪、失焦重對焦放在 GPU 上執行,可用自然語言(如「shadows +25」)或直接在照片上拖拽調參,編輯以標準 XMP 存在照片旁、不改原圖。另含筆刷與 AI 主體/深度蒙版、HDR 與全景合併、1000+ 相機 RAW 和 1500 個鏡頭配置檔案,並可自託管在瀏覽器中使用。