AISpot

搜尋

依意思最接近的 21 筆

r/LocalLLaMA top of the day10/2 20:17AI 評分52

自託管 AI 並不省錢,博主稱仍會繼續本地部署

使用者 basnijholt 在 Reddit 發帖並附上部落格文章,論證自託管 AI 並不比用 API 更省錢,但他表示自己照樣會做。他提出兩點:把 200 美元的訂閱(如 Opus 5.5、Astra)與 Qwen 3.8 27B 這類本地模型直接比價並不對等;他也不會把 200 GB 的郵件、聊天記錄和位置歷史交給 API,哪怕對方承諾零資料保留。帖子發出後引發了不少爭議。

量子位● 精選10/1 16:02AI 評分80

Google 突然發布 Gemini 4 Argon,多項榜單登頂

Google 於 2026 年 10 月 1 日發布 Gemini 4 Argon,在 DeepSWE v1.1 長期軟體工程任務得 77.9%,高於 Claude Opus 5.5 的 74.2% 和 GPT-6 Astra 的 74.1%,並以 68.90% 登頂 Vals Index。定價為每百萬輸入 Token 2 美元、輸出 Token 10 美元,優惠期單題成本比 Astra 低約四成,輸出上限達百萬 Token。

量子位10/4 01:53AI 評分44

Meshy 不到兩年 ARR 從 100 萬漲到 1 億美元

AI 3D 生成公司 Meshy 披露,其 ARR 從 100 萬美元增長至 1 億美元,用時不到兩年,比 HeyGen 的 29 個月更快。增長來自三層收入:個人訂閱、企業 API(三七互娛、網易遊戲、Nexon 等已接入生產管線)以及 3D 列印硬體生態(拓竹、創想三維等)。Meshy 7.1 將幾何生成解析度從 2048³ 提升至 4096³,並推出即時互動架構 Mora。

r/OpenAI top of the day10/3 10:06AI 評分56

ChatGPT 跑 30 分鐘才報用量超限,不提前提醒

有使用者用 GPT-6 Astra 處理 10 萬字元以上素材生成 70 多頁文件時,任務跑 30 到 40 分鐘、消耗大量算力後,直接報 5 小時用量上限錯誤,一個字都沒輸出。使用者只能新開對話、縮小任務重試,反覆多次。按 ChatGPT 與 Gemini 估算,這類大規模執行每次 API 等效算力成本約 3 到 5 美元。

NVIDIA blog10/1 14:00AI 評分22

NVIDIA 提出 AI 工廠回報三要素,稱 Vera Rubin 每兆瓦吞吐超 GB300 30 倍

NVIDIA 提出衡量 AI 工廠投資回報的三個變數:產能(每兆瓦吞吐與每 token 成本)、使用壽命和需求。它援引 SemiAnalysis AgentX 資料稱,Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 上每百萬 token 成本最多低 45 倍;每兆瓦 AI 工廠造價約 6000 萬美元。

Hugging Face blog● 精選10/2 16:19AI 評分65

Ai2 開源 AstaBrief 8B 科學報告生成模型

Ai2 開源了 8B 的科學報告生成模型 AstaBrief,可把研究問題和檢索到的文獻片段直接寫成帶引用的報告。它已在 Asta 的 Generate a report 功能中以 Fast mode 上線,與 Claude 驅動的 Thinking mode 並列:Fast mode 平均 51.1 秒生成一份報告,Thinking mode 為 178.5 秒,快約 3.5 倍。模型基於 Qwen3-8B,用 SFT 加 DPO 訓練,一次成稿,跳過了片段摘要與聚類環節。

Cloudflare blog (AI)10/1 14:04AI 評分63

Workers AI 上線 EuroLLM 與 Apertus 兩款歐洲開源模型

Cloudflare 在 Workers AI 上線兩款由歐洲公共機構訓練的開源模型:覆蓋全部 24 種歐盟官方語言的 EuroLLM,以及瑞士 ETH Zurich、EPFL 等打造的 Apertus,今天即可申請訪問。Apertus 用逾 15 萬億 token、1500 多種語言訓練,40% 訓練資料非英語,架構、權重、資料與方法全部公開,並按 EU AI Act 與 GDPR 處理訓練退出與個人資料。

Hacker News front page10/2 22:25AI 評分62

Ai2 開源 AstaBrief 8B 科學報告模型與訓練資料

Ai2 開源 AstaBrief 8B:一個把研究問題與檢索到的文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 用 SFT 與 DPO 訓練,權重、訓練資料和一份可從自己 PDF 生成報告的範例工作流一併放出。它已作為 Asta 的 Generate a report 功能中的 Fast mode 上線,與 Claude 驅動的 Thinking mode 並存;

r/LocalLLaMA top of the day10/3 02:58AI 評分32

LocalLLaMA 網友曬本地跑模型硬體方案

r/LocalLLaMA 使用者 pmarsh 發帖稱自己已接近本地推理硬體投入的中間水平,評論區隨即給出多種低成本方案:2014 至 2018 年的 2 至 4 路 DDR3 CPU 伺服器可跑 qwen 3.8 flash 超 15 tok/s;雙 7900XTX 不到 2000 美元可跑 27B Q8 超 220k 上下文;CMP 170HX 視訊記憶體超頻可達 2TB/s,單流解碼約 60 tok/s。

Latent Space● 精選10/1 07:45AI 評分84

Gemini 4 Argon 發布,輸出上限 100 萬 token,僅限安全預覽

Google DeepMind 發布 Gemini 4 Argon,首次支援最高 100 萬 token 輸出,但目前僅在 Fairwind 計劃下對政府使用者與受信任網路安全人員開放預覽,開發者、企業與消費者開放時間未定。標準價 $4/$20 每百萬輸入/輸出 token,首推五折 $2/$10,快取輸入 95% 折扣;19 項公開基準中拿下 13 項第一。100 萬輸出靠新 API 功能 Long Decode Continuation 實現,長回覆會暫停並跨呼叫續寫;

Simon Willison● 精選10/4 00:34AI 評分70

AWS 與 Google Cloud 推出硬性預算上限

AWS 在 9 月 16 日推出月度支出上限功能,專案用量達到上限後當月暫停;Google Cloud 則在 7 月上線 Spend Caps,可對專案內特定服務設定月度財務上限。作者認為按量付費的 API 與託管服務應預設開啟硬性預算上限,而非只發警告郵件,因為 coding agent 會大幅降低啟動付費服務的門檻,可能在你睡覺時燒掉數百甚至上萬美元。AWS 該功能目前僅向少量客戶開放,尚未全面可用。

r/LocalLLaMA top of the day10/3 05:10AI 評分33

新模型寫作風格趨向高資訊密度與生僻詞彙

有使用者觀察到,近期開源與閉源模型(如 GLM 5.3 Flash)的寫作風格正趨向高資訊密度和更豐富的詞彙,用更少的詞表達更多內容,類似 William Gibson 的壓縮文風。作者認為這可能與 token 效率最佳化有關,但代價是普通讀者難以一眼讀懂,例如模型會使用 Baudrillardian 這類生僻詞。

Simon Willison10/3 23:00AI 評分25

Simon Willison 發布九月贊助者專屬通訊

Simon Willison 已傳送九月贊助者專屬月度通訊,贊助者可立即訪問。本期涵蓋更多 Fable 級模型、一場價格戰、3D 圖形與 Blender、LLM 進軍數學、更多意外網路攻擊、Datasette 漏洞危機、作者當前使用工具、本月軟體發布及 2026 年 LLM 進展回顧。訂閱費為每月 10 美元,可提前一個月看到免費版內容。

Hacker News front page10/3 11:43AI 評分74

Aleph Alpha 發布開源模型 Kolibri,Apache 2.0 權重

德國 Aleph Alpha 於 2026 年 10 月 3 日發布開源權重模型 Kolibri,Apache 2.0 許可,權重已上 Hugging Face。它是 78.1B 引數的 MoE 模型,每 token 僅啟用 3.46B,支援德語和英語,原生上下文 262,144 token,FP8 權重約 78 GB,知識截止 2026 年 6 月 18 日。

Latent Space● 精選10/3 09:45AI 評分85

GPT-6.1 Sol 發布,Sonnet 5.5 登頂 Agent Arena

OpenAI 發布 GPT-6.1 Sol,定價 $2/$10 每百萬輸入/輸出 token,比 Astra 的 $10/$50 便宜約 80%,在 DeepSWE v1.1 上比 GPT-6 Sol 高 6.4 分。Sonnet 5.5 在 Agent Arena 首秀排第 3 並在 Chat 類別登頂,Anthropic 包攬前三;Sol 每任務中位成本 $0.56,比 GPT-6 Sol 便宜 39%。