AISpot

開源

10月2日星期五 · 4 則

  1. Latent SpaceAI 評分51

    Airbnb 稱 60% 程式碼由 AI 編寫,靠內部工具 Everest 加速開發

    Airbnb CTO Ahmad Al-Dahle(前 Meta 生成式 AI 負責人、Llama 系列發布負責人)披露,Airbnb 目前約 60% 的程式碼由 AI 編寫,功能交付量同比增加近 80%,工程師的 PR 吞吐量提升約 1.6 倍。約一半客服工單已由 AI 獨立解決(Q2 財報為近 45%),但安全類問題仍轉人工,上線前用合成資料做測試。

  2. 量子位AI 評分52

    openJiuwen 首發 X-Router 自演進模型路由,實測省 50%+ Token

    openJiuwen 首發 X-Router 自演進模型路由技術,按任務複雜度在本地與雲端模型池中動態選模型,實測減少 50%+ Token 消耗。該平台由華為 2012 實驗室、華為雲等團隊聯合高校與企業建置,主打昇騰親和,路由分三層:優於 1 分鐘重新整理的模型能力畫像、結合 KV 快取親和與即時負載的啟發式決策、用 Contextual Bandit 與輕量強化學習做反饋自演進,樣本不足時保留原判定。

10月1日星期四 · 5 則

  1. Cloudflare blog (AI)AI 評分63

    Workers AI 上線 EuroLLM 與 Apertus 兩款歐洲開源模型

    Cloudflare 在 Workers AI 上線兩款由歐洲公共機構訓練的開源模型:覆蓋全部 24 種歐盟官方語言的 EuroLLM,以及瑞士 ETH Zurich、EPFL 等打造的 Apertus,今天即可申請訪問。Apertus 用逾 15 萬億 token、1500 多種語言訓練,40% 訓練資料非英語,架構、權重、資料與方法全部公開,並按 EU AI Act 與 GDPR 處理訓練退出與個人資料。

  2. Cloudflare blog (AI)AI 評分45

    Cloudflare OS 開放全託管等待名單,新增 GitHub 倉庫與 Google Workspace 支援

    Cloudflare OS 開放全託管部署的等待名單:企業只需在 Cloudflare 控制台指定自訂域名、Access 策略與 AI Gateway,其餘配置與運維由 Cloudflare 負責。該產品上月開源,已有數千家組織用它處理公司資料、生成文件幻燈片和自動化任務。

  3. X @GoogleDeepMindAI 評分42

    @GoogleDeepMind: As AI accelerates scientific discovery, we’re helping researchers keep pace by quickly authenticati…

    Google DeepMind 發布了一套可快速驗證生物設計是否內建安全防護的工具,並以開放方式供研究使用。該工具面向科研人員,目的是在 AI 加速科學發現的同時,不拖慢關鍵研究進度。官方未披露具體模型名稱、效能資料或使用限制,僅提供研究用途的開放獲取連結。

  4. Anthropic Research● 精選AI 評分68

    物理學家用 Claude 打造 BootLoops 科研工具

    理論物理學家 Matthew Schwartz 發布開源工具 BootLoops,把 Claude 當作 LLM 的"挽具",專攻適合當前 AI 的"Claude 形狀"問題。他用 Claude Fable 5 移植並改進散射振幅計算方法,還借 BootLoops 把數學物理技術帶到生態學、群體遺傳學、地質、經濟、語言學等領域,並與各領域專家合作篩選真正有價值的問題。BootLoops 開源,可搭配任意模型使用,但當前 AI 仍無法解決科學中的大多數問題。

9月30日星期三 · 1 則

  1. Hugging Face blogAI 評分46

    Hugging Face 發布 Open TTS Leaderboard,用客觀指標評多語言 TTS 與語音克隆

    Hugging Face 於 2026 年 9 月 30 日上線 Open TTS Leaderboard,用客觀指標評測開源與多語言 TTS 模型,單次評測從收集投票的數週縮短到數小時。指標包括 WER/CER(用 Qwen3 ASR 轉寫)、H200 批次離線推理的 RTFx、H200 與 CPU 上的流式首音訊延遲 TTFA,以及 WavLM 說話人嵌入的餘弦相似度 SIM。

9月29日星期二 · 3 則

  1. Hugging Face blogAI 評分53

    NVIDIA 開源表格基礎模型 Kumo Tabular,登頂四個基準

    NVIDIA 發布 Kumo Tabular,一個面向表格分類與迴歸的開源基礎模型,權重已上線 Hugging Face,程式碼開源於 GitHub。給定一張帶標籤行的表格,它在單次前向傳播中直接輸出新行的類別機率或數值預測,無需訓練、調參和特徵工程;模型僅用人工合成表格預訓練,提供 28M 到 215M 三種引數規模,採用 OpenMDW-1.1 許可證,可商用。

  2. MLX releases● 精選AI 評分70

    v0.32.3

    MLX 發布 v0.32.3,一批修復覆蓋 Metal、CUDA 與 CPU 後端,並新增面向 M5 的非量化 matmul 調優。Metal 側加入 gated delta nets 核心與 fast.cross_entropy 融合核心,降低 SDPA D256/D512 記憶體佔用,同時修復 fp 量化 matmul 在量化維度非 32 倍數時的結果損壞、GGUF 張量維度校驗與零尺寸軸的 scan/sort。

9月28日星期一 · 2 則

  1. OpenCode releases● 精選AI 評分63

    OpenCode v1.18.33 修復 Cloudflare 超時與 Gemini 思考引數

    OpenCode 發布 v1.18.33:Cloudflare AI Gateway 上的模型現在會遵循 provider 的回應與流超時,Gemini 的 thinking 預設值與 effort 選項也與各代模型支援的控制對齊。同版本還讓 MCP 瀏覽器啟動失敗在啟動器立即退出時被報告,並讓除錯配置輸出遮蔽憑據與敏感 header。

  2. Mistral AI newsAI 評分41

    Mistral 在慕尼黑開設德國中心,聚焦工業 AI 與 Physics AI

    Mistral 於 2026 年 9 月 28 日在慕尼黑開設德國中心,內設 Physics AI 與 Industrial AI 研究團隊及直接服務企業客戶的應用工程師,並已在當地招聘。合作方包括 BMW(碰撞模擬與工程 AI)、Siemens Energy(工業 AI),以及與慕尼黑工業大學(TUM)用其風洞設施開發汽車空氣動力學數字孿生。

9月25日星期五 · 1 則

  1. Ollama releases● 精選AI 評分86

    Ollama v0.40.0:Apple Silicon 上預設改用 MLX 執行模型

    Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構會自動改用 MLX 執行,無需手動切換。用法與以往一致,例如 ollama pull qwen3.8 後 ollama run qwen3.8。該版本目前為預發布版(v0.40.0-rc0,變更範圍 v0.34.4 到 v0.40.0-rc0),官方稱預發布期間會測試並啟用更多模型,尚未說明具體支援清單與效能差異。

9月22日星期二 · 1 則

9月21日星期一 · 1 則

9月19日星期六 · 2 則

9月18日星期五 · 1 則

  1. LM Studio blog● 精選AI 評分82

    Inco AI 開源 Splash 引擎,最佳化 Apple Silicon 本地推理

    Inco AI 發布開源推理引擎 Splash,專為在 Apple Silicon 上本地執行 Qwen3.6-35B-A3B 與 Qwen3.8-27B 最佳化,已整合進 LM Studio Bionic 1.1.5 及以上版本。在 48GB M5 Pro 測試中,Qwen3.8-27B 短提示解碼約 74 tokens/s、32K 上下文 54 tokens/s,約為次快引擎的兩倍;四個併發請求合計吞吐 170 tokens/s,是次快引擎的 3.9 倍。

9月16日星期三 · 1 則

  1. Mistral AI news● 精選AI 評分60

    Firefox 智慧視窗測試版改由 Mistral 模型驅動

    Mistral 與 Mozilla 於 2026 年 9 月 16 日宣布合作,Firefox 的 AI 瀏覽助手 Smart Window(測試版)改由 Mistral 模型驅動。該功能先面向法國和北美使用者,英國和德國預計今年晚些時候跟進。Smart Window 可解讀複雜搜尋、找回此前點開的頁面,並基於瀏覽器標籤頁整理資訊;Mozilla 表示對話預設不儲存在其伺服器上,Mistral 也同意零資料保留。

9月10日星期四 · 2 則

  1. Mistral AI newsAI 評分42

    Mistral 與 Cloudera 合作,模型可部署於本地及氣隙環境

    Mistral 與 Cloudera 於 2026 年 9 月 10 日宣布合作,把 Mistral 模型整合進 Cloudera 混合資料平台,企業可在私有云、公有云、本地乃至完全氣隙環境中執行推理。企業還能在受控環境裡用自有專有資料訓練定製模型,並以開放權重方式擁有模型與資料。Cloudera 稱其平台上執行著客戶自管的 30 EB 資料,合作面向金融、製造、電信等受監管行業,核心是讓資料、智慧、算力與運營留在客戶手中。

9月8日星期二 · 2 則

  1. Mistral AI news● 精選AI 評分67

    Mistral 完成 30 億歐元 D 輪融資,三星電子領投

    Mistral 宣布完成 30 億歐元 D 輪融資,投後估值超過 210 億歐元,是歐洲科技公司史上最大股權融資;本輪由三星電子領投,EQT 管理的 Scaleup Europe Fund 與現有投資方 PSG Equity 共同領投。新投資方包括 Advent、貝萊德管理的基金及盧森堡大公國,a16z、ASML、NVIDIA、Salesforce Ventures 等老股東跟投。資金將用於擴充套件前沿研究、擴大算力與基礎設施、加速商業增長和國際佈局;

9月4日星期五 · 1 則

8月28日星期五 · 1 則

8月27日星期四 · 1 則

8月25日星期二 · 1 則

8月18日星期二 · 1 則

8月11日星期二 · 1 則

  1. Ollama blog● 精選AI 評分90

    NVIDIA Nemotron 3.5 Lightning 上線 Ollama,可完全本地執行

    NVIDIA 的 30B 總引數(3B 啟用)開源模型 Nemotron 3.5 Lightning 已上線 Ollama,可完全在本地裝置執行。它採用混合 MoE 架構,支援最長 1M token 上下文,並用多 token 預測、DFlash 或 DSpark 投機解碼,吞吐達同類開源模型 4 倍、任務完成時間快 30%,面向呼叫工具、跑測試、檢索程式碼庫等長時 agent 任務。

8月10日星期一 · 2 則

7月7日星期二 · 1 則

4月22日星期三 · 2 則

  1. MLX LM releases● 精選AI 評分65

    MLX 發布 v0.31.3,修復快取與工具呼叫多個 bug

    MLX 在 2026-04-22 發布補丁版 v0.31.3,以大量 bug 修復為主,並新增執行緒本地生成流(thread local generation stream),配合 MLX v0.31.2。修復覆蓋 BatchKVCache、BatchRotatingKVCache 與 ArraysCache 的 batch 維度不匹配,以及服務端並行工具呼叫、MiniMax M2 並行工具呼叫和 Mistral 空 tool_call_end 導致的工具呼叫中斷。

  2. MLX releases● 精選AI 評分74

    MLX v0.31.2 發布,CUDA 量化矩陣乘與多執行緒支援增強

    MLX 發布 v0.31.2,把 CUDA 後端的量化矩陣乘擴充套件到了 3/5/6-bit、int4 與浮點量化(qmm_naive、qmm_sm80),並新增 GatherQMM 和 CUDA FFT。框架現在支援多執行緒執行獨立計算:CommandEncoder、ThreadLocalStream 改為執行緒本地,Scheduler::enqueue 執行緒安全,JACCL 拆分為獨立庫。

4月7日星期二 · 1 則

  1. MLX LM releases● 精選AI 評分75

    mlx_lm 發布 v0.31.2,新增 Gemma 4 支援並重構批處理生成

    MLX 生態的 mlx_lm 發布 v0.31.2(上一版為 v0.31.0),重點是新增 Gemma 4 支援,包括工具呼叫解析器、多 token 的 think 與工具起止標記,並修復其量化逐層投影載入。此次還重構了 BatchGenerator、為非裁剪型快取快取系統提示與使用者訊息,批處理生成器恢復 max-kv-size 引數,伺服器新增 --allowed-origins 選項,並加入 Nemotron super 支援。

3月7日星期六 · 1 則

2月12日星期四 · 1 則

  1. MLX LM releases● 精選AI 評分84

    v0.30.7 發布:修復 Kimi Linear、DeepSeek V3.2,新增 GLM5 與 Qwen3.5

    2026 年 2 月 12 日發布的 v0.30.7 修復了 Kimi Linear 與 DeepSeek V3.2 的 indexer 和權重載入問題,並加快 DSV32 生成速度。這一版新增 GLM5、不含視覺能力的 Qwen3.5 系列與 LongCat MLA 支援,LFM2 模型可用 Pythonic 方式呼叫工具,另加入 Mistral 工具解析器。訓練流程中的驗證集改為可選,還有一項為下一版本提號的版本號變更。

更早的內容