搜尋 關鍵字 語意 依意思最接近的 30 筆
X @Alibaba_Qwen● 精選 10/9 09:24 AI 評分79
阿里發布 Qwen-Image-2.1-Turbo,這是基於 Qwen-Image-2.1 的加速 checkpoint,只需 8 步去噪即可生成和編輯影像,權重已在 ModelScope 與 Hugging Face 開放。它沿用同一 7B 視覺生成架構,官方稱步數減少不犧牲品質,仍可從文字生成 2K 影像,並支援用自然語言繼續編輯,例如新增配飾或更換場景。Diffusers 中載入 QwenImage21Pipeline 即可使用推薦的 8 步取樣;
X @Alibaba_Qwen10/9 09:24 AI 評分6
阿里 Qwen 官方 X 帳號在 2026 年 10 月 9 日發布動態,正文只有「Pics:」一詞,隨附圖片,沒有任何文字說明。公開可見的文字裡沒有出現模型名稱、版本號、功能或發布時間,因此無法確認圖片指向哪款產品或更新。要了解具體內容只能檢視原帖圖片,後續說明有待官方補充。
Hugging Face blog● 精選 10/7 20:00 AI 評分78
Hugging Face 的 yuvraj sharma 用 HuggingChat 裡的 ML Intern agent,幾天內做出 6 個公開模型,其中把 Qwen-Image 2.1 自帶的 9B 提示改寫器蒸餾成 0.8B 版本,可在 CPU 執行,輸出有效率 99.7%,token 消耗約為教師模型的四分之一。該專案含 9B 模型標註 8,797 條樣本,算力成本 16 美元。
Gemini API release notes● 精選 10/5 20:00 AI 評分79
Gemini Nano Banana 2.1(gemini-nano-banana-2.1)已正式 GA,這是最新的高效率影像生成與對話式編輯模型,也是 gemini-3.1-flash-image 的更新版本。它在保持 Flash 級速度與成本效率的同時,提升了視覺品質、提示詞遵循、多輪角色一致性、文字渲染,並支援 1:4、4:1、1:8、8:1 的寬幅與全景比例,覆蓋 1K、2K、4K 解析度。
機器之心● 精選 10/8 22:40 AI 評分78
VideoGen-Agent 用 Qwen3-VL-8B-Instruct 做基座,在多輪互動中呼叫檢索、生成與驗證工具,先以 16K 教師軌跡監督微調,再用 8K 提示做多工強化學習。在 600 條提示的 VABench 上,Toolset 1 配置得 75.6 分,比基礎生成器 56.5 分高出 19.1 分;智慧體策略不變、僅升級生成工具後達 86.1 分,人類評估中 84.3% 的判斷偏好該配置。
機器之心● 精選 10/7 08:28 AI 評分80
Google DeepMind 正式發布 Nano Banana 2.1,底層由 Gemini 3.6 Flash 驅動,模型 ID 為 gemini-nano-banana-2.1,已作為穩定模型上線 Gemini App、AI Studio、Gemini API、Search AI Mode、Google Ads、Flow 與 Stitch。新版定位高效率影像生成與對話式編輯,支援 1K/2K/4K 輸出、最多 14 張參考圖融合,重點強化設計版式、蒙版區域性編輯和主體一致性;
Simon Willison● 精選 10/6 19:04 AI 評分65
OpenAI 發布新的 Decisions API,支援 yes/no、選項和打分三類問題,新模型 gpt-6-luna 相比 Jev 額外支援影像輸入。兩者都只對輸入計費:OpenAI 為 10 美分/百萬輸入 token,Jev 為 4.2 美分/百萬。
r/LocalLLaMA top of the day10/3 02:49 AI 評分68
有人在 Windows 上用 llama.cpp 的專家流式方案,在單張 RTX 5070 12GB 加 32GB DDR4-2400 記憶體上執行 Qwen3.8-Flash-Next 177B(UD-IQ3_XXS),基準約 11.5 tok/s,日常對話可達 14-15 tok/s。一次長程式設計提示以 10.15 tok/s 生成 4,892 個 token,產出一個可執行的單檔案貪吃蛇遊戲。
r/LocalLLaMA top of the day10/3 14:58 AI 評分75
開發者 roofkid 發布 Ninfer 4080,在 RTX 4080 16GB 上以 100k 上下文執行 ISTA-DASLab-Qwen-3.8-27B-GSQ,實測最高 prefill 2720 tok/s、生成 262 tok/s。專案採用 DFlash2 推測解碼與 KV 壓縮,程式碼已在 GitHub 開源並提供 Docker 映象。
X @OpenAI10/7 14:05 AI 評分18
OpenAI 官方帳號發布推文,稱用視覺化內容把概念呈現出來,可以加深使用者對某個主題的理解。推文只有這一句話,未說明對應哪款產品或功能,也沒有給出上線時間和具體用法。
量子位● 精選 10/6 02:45 AI 評分89
OpenAI Codex 負責人 Tibo 的 28 天計劃首日,官方宣布 GPT-6 Astra 與 GPT-6.1 Sol 預設推理速度提升約 50%、達 50TPS,覆蓋官方訂閱及 OpenCode、Amp 等第三方接入,但網友實測僅約 35TPS。同期 OpenAI 在 ChatGPT 影像生成中測試視覺廣告,並將在幾週內為歐盟地區 ChatGPT 和 Codex 生成的文字加隱形水印。
Hacker News front page10/6 12:23 AI 評分73
一個由 AI 設計的開源 AI 加速器 openTPU 已在真實 PCIe 卡上跑通十餘款模型的真實權重,輸出與 bit-exact 模擬器逐位一致。硬體是 Xilinx Kintex-7 xc7k480t 加兩路 DDR3,LFM2.5-230M int8 解碼 59.0 tok/s、4-bit 達 85.8 tok/s;解碼受 DRAM 頻寬限制,實測跑到峰值的 82%-94%。
OpenCode releases10/6 16:18 AI 評分43
OpenCode 發布 v1.18.35,核心改進是新增 canonical redirects,並提供 JSON 與 Markdown 兩種格式的 agent 可讀統計資料。本次修復讓 xAI 的工具呼叫結果可以攜帶受支援的圖片,不支援的圖片格式會被跳過,做法是把 @ai-sdk/xai 升級到 3.0.139。文件方面,Zen 文件新增 Fledge Alpha Free,生態外掛列表加入 opencode-supabase,該版本同時致謝 3 位社群貢獻者。
Ars Technica AI10/7 17:56 AI 評分61
開發者 Brandon Thomas 用 Anthropic 的 Claude Opus 5.5 生成了七款開源應用,復刻 Adobe 的 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 與 Acrobat Pro 的介面和工具。Artcraft 去年以「面向藝術家的可控 AI」起步,用於 AI 生成影像與影片的精確後期編輯,本週末宣布轉向這套套件並在 Reddit 公布。
機器之心10/4 07:31 AI 評分50
OpenAI 產品負責人 Tibo Sottiaux 發帖預告未來模型會更擅長刪除和簡化程式碼,並在評論中確認 Astra 6.1「coming soon」。負責 coding post-training 的研究員 Rajan Agarwal 轉發該帖,並公開徵集使用者遇到的 sloppy code 與程式碼品質問題。《華爾街日報》此前報導,Astra 6.1 原計劃 10 月發布,因內部安全測試中在權限邊界上表現不穩而被臨時叫停。
X @Alibaba_Qwen10/8 23:36 AI 評分43
阿里 Qwen 宣布,Qwen3.8-Max、Qwen3.8-Flash 與 Wan3.0 在 GMI Cloud 上限時免費開放一週,活動已經上線。開發者可在此期間免費呼叫這三款模型進行建置與測試,官方在推文中邀請開發者探索可行的用法。
Hacker News front page10/4 08:51 AI 評分62
開源專案 Strata 可在普通遊戲 PC 上本地執行 125B 引數的 Qwen3.8-Flash-Next,支援聊天、寫程式碼、讀圖和接入 coding agent,資料不出本機。官方實測 RTX 5070(12GB)在 Q2_0 量化下寫答案 94 tokens/s、讀 32K 提示 2650 tokens/s;RTX 3090(24GB)預計可達 100-140 tokens/s。
Hugging Face blog● 精選 10/2 11:19 AI 評分70
Ai2 開源了 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,已作為 Asta 的 Fast 模式上線。官方稱 Fast 模式平均 51.1 秒生成一份報告,比 Claude 驅動的 Thinking 模式 178.5 秒快約 3.5 倍。模型權重、訓練資料與範例工作流一併開放,機構可在自有基礎設施上本地生成報告。
機器之心● 精選 10/8 22:35 AI 評分89
OpenAI 發布 GPT-6.1 Sol 的 Ultrafast 模式,官方稱智慧水平與標準版一致、仍逼近旗艦 Astra,但速度是標準版的 8 倍。其 API 定價為每百萬輸入 token 12 美元、輸出 60 美元,是標準版(2 美元 / 10 美元)的 6 倍,API 呼叫不受訂閱等級限制。
機器之心● 精選 10/7 08:35 AI 評分73
哈工大(深圳)與新加坡國立大學團隊提出免訓練 2-bit KV Cache 量化框架 QuantWM,面向影片世界模型,實際壓縮最高 6.20 倍。研究指出,現有量化方法在 VBench 等指標上接近 BF16,畫面卻仍有閃爍、模糊和失真,原因是 Key 的量化誤差改變了注意力分數排序,使模型選中不同的歷史幀或影像塊。
r/LocalLLaMA top of the day10/2 21:33 AI 評分42
作者發布專為 RTX5090 打造的推理引擎 MegaCapybara,聚焦 Qwen3.8 27B,解碼速度約為此前 SOTA 引擎 Ninfer 的兩倍:單任務編碼可達 500+ t/s,12 個 agent 併發、800k 上下文時可達 2000+ t/s。引擎具備 VRAM-RAM-DISC 快取管理、雙層 Loop Guard、帶後設資料的自研權重格式(可對比 BF16 顯示 KL 與 top-1% 損失)以及圖形介面,採用 MIT 許可,原始碼與權重建置器後續發布。
r/LocalLLaMA top of the day● 精選 10/2 17:47 AI 評分80
有人在單張 RTX PRO 6000 上對三個 Qwen3.8 檢查點做了 10 項測試:RadixArk 27B NVFP4、orcarouter 27B Uncensored NVFP4 和 Flash-Next NVFP4。27B 配 DFlash2 草稿模型後 Spec-Bench 從 75 提到 210 tok/s,約 2.8 倍;SGLang 整體快於 vLLM,但同一匯出上 vLLM 快 16%。
NVIDIA blog● 精選 10/1 19:44 AI 評分85
GPT-6 Astra Ultrafast 已在 OpenAI API 上線,並向符合條件的 ChatGPT Work 與 Codex 使用者開放,執行在 NVIDIA Blackwell GPU 上。官方稱其 token 生成速度最高可達 Astra Standard 模式的 8 倍,可縮短 coding agent 的編輯—測試—除錯迴圈,並減少工具呼叫之間的等待。開發者可通過 API 使用,訪問方式、價格與實現細節見 Ultrafast 指南。
The Verge AI● 精選 10/5 09:09 AI 評分77
OpenAI 將於本月晚些時候在美國開始測試新的視覺廣告,在 ChatGPT 生成圖片時展示贊助商品的圖片。廣告與生成的圖片分開顯示,OpenAI 稱不會影響 ChatGPT 給出的回答。OpenAI 今年 2 月首次在 ChatGPT 投放廣告,此前廣告只顯示公司名、logo 和產品連結,位於對話下方的 sponsored 區域。訂閱 Plus、Pro 等方案的使用者不會看到廣告。
機器之心10/8 09:30 AI 評分51
生數科技推出影片模型 Vidu Q4 Preview,是其面向創作者的首個預覽版本,首發價格 0.09 元/秒起,同樣預算最高可生成 5 倍內容。該版本主打人物演繹、鏡頭語言與複雜視效,支援最多 15 張參考圖、3 段參考音訊輸入,以及 2K、4K 畫質輸出。官方資料顯示其圖生影片速度約為同類模型的 2 倍,5 秒影片最快約 110 秒完成,正式版上線時間尚未公布。
Hacker News front page10/2 17:25 AI 評分71
Ai2 於 2026 年 10 月 2 日開源 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,採用 SFT 加 DPO 而非強化學習。它已作為 Asta 的 Fast 模式上線,與 Claude 驅動的 Thinking 模式並列,整條流水線平均每份報告 51.1 秒,比 Thinking 模式的 178.5 秒快約 3.5 倍。
OpenAI News● 精選 10/5 06:00 AI 評分85
OpenAI 宣布在 ChatGPT 推出新的視覺廣告格式,並擴充套件廣告測量工具與合作伙伴。該格式初期在影像生成過程中測試,廣告會明確標註且與生成的圖片分開,不影響 ChatGPT 給出的回答,本月晚些時候在美國面向首批廣告主開始。ChatGPT 每週觸達 12 億人。OpenAI 同時接入 Hightouch、Tealium、LiveRamp 的轉化資料整合,與 AppsFlyer、Adjust 等歸因夥伴合作,並與 DoubleVerify、IAS 試點品牌適配性評估。
X @ollama● 精選 10/6 17:32 AI 評分65
Google DeepMind 的 EmbeddingGemma 2 已上線 Ollama,執行 ollama pull embeddinggemma-2 即可拉取。訊息由 Ollama 官方帳號在 10 月 6 日發布,官方稱該模型面向消費級裝置,並且是多模態模型。原文未披露模型體積、上下文長度與具體支援的模態等細節。
r/LocalLLaMA top of the day10/3 02:18 AI 評分70
llama.cpp 的 PR #29825 通過最佳化索引器分數記憶體,把 Qwen Flash Next 等 Qwen4 模型的視訊記憶體佔用減半。實測在上下文 131072、ub 2048 時從 3.0 GiB 降至 1.5 GiB,262144、ub 4096 時從 11.7 GiB 降至 5.6 GiB。作者稱 logits 逐位一致、pp/tg 速度不變,僅分數因 fp32 舍入有差異;有使用者反饋解碼速度約降 10%。
X @ggerganov● 精選 10/6 09:27 AI 評分75
llama.cpp 作者 Georgi Gerganov 建議使用 Qwen3.8-27B + MTP 的使用者升級到 DFlash,以獲得額外速度提升。啟用方式是在最新 llama.cpp v0.6.0 上執行 llama serve -hf ggml-org/Qwen3.8-27B-GGUF,並加上 --spec-type draft-dflash 與 --spec-draft-n-max 7 兩個引數。該提示未給出具體提速幅度,只強調必須使用最新版本。