AISpot

搜尋

找到 44 筆

r/LocalLLaMA top of the day10/3 19:58AI 評分49

開發者發布 Ninfer 4080,16GB 顯示卡可跑 100k 上下文

開發者 roofkid 發布 Ninfer 4080,讓 RTX 4080 16GB 顯示卡以 100k 上下文執行 ISTA-DASLab-Qwen-3.8-27B-GSQ,最高預填充 2720 tok/s、生成 262 tok/s,程式碼已在 GitHub 開源並提供 Docker 映象。它採用 DFlash2 投機解碼,作者稱預填充與生成速度明顯優於 llama.cpp、vllm 等通用推理引擎,代價是 KV 量化帶來輕微精度損失。

r/ClaudeAI top of the day10/3 11:52AI 評分55

開發者用 Claude Code 與 Remotion 生成發布影片,帶來 10 位客戶

一位獨立開發者用 Claude Opus 智慧體(Claude Code)配合 Remotion 製作了 Mac 應用 Tack+ 的發布影片,並因此獲得前 10 位客戶。影片全長 45 秒、60 fps,輸出 1080p 與 4K,含法語和英語版本,全部由程式碼生成,沒有 After Effects、素材庫或授權音樂。智慧體無法直接看影片,就渲染幀聯絡表自行檢查並修正標題重疊、轉場空白等問題,但聲音部分它只能測響度和峰值,無法試聽,需人工把關。

r/ClaudeAI top of the day10/3 16:14AI 評分51

非開發者用 Claude Code 一個月為工廠搭出生產系統

一位法國傢俱廠運營總監用 Claude Code 在 30 天內做出生產管理系統,已上線供辦公室和車間每天使用。系統含 386 次提交、約 17.5 萬行 Python 與原生 JS、約 2100 個測試、約 580 個 API 路由、約 280 張 SQLite 表,技術棧為 FastAPI + SQLite + HTML/JS,跑在廠內 Windows 機器上。

r/ClaudeAI top of the day10/3 01:58AI 評分21

開發者用 Claude 一週做出飛艇版 FTL 遊戲

一位開發者用 Claude 200 美元月費方案和 GPT 100 美元月費方案,在一週內做出了一款類似 FTL 的飛艇策略遊戲 Magehold: Fairwinds,目前可在 mageholdworld.com 免費試玩,幾週後登陸 Steam。遊戲支援 Linux 和 Mac,含 7 種語言本地化和 100 個 Steam 成就,Claude 還生成了美術資產、測試機器人和預告片。作者稱整體迭代 30 多次,後續將加入分支任務鏈和天氣效果。

r/ClaudeAI top of the day10/3 16:09AI 評分22

開發者用 Claude 迭代 3D 畫素遊戲 Willowmere

開發者用 Claude 迭代了 3D 畫素風遊戲 Willowmere 的第二版,全部畫面由程式碼生成,無素材檔案、無遊戲引擎,僅用原生 HTML 和 JS,可在瀏覽器免費試玩。新版加入完整劇情三幕與結局、低潮趕海、做燈籠、月下釣魚和 Keep Watch 等玩法,並完成美術動畫與 3D 表情頭像的整體打磨。作者稱本次迭代主要用中等強度配合 Opus 5.5 完成。

Anthropic News10/1 01:00AI 評分45

巴克萊銀行擴大與 Anthropic 合作,2026 年底 Claude Code 覆蓋半數開發者

巴克萊銀行宣布擴大與 Anthropic 的戰略合作,在全行範圍部署 Claude,目標是 2026 年底 Claude Code 覆蓋其 50% 的開發者,2027 年覆蓋多數軟體工程師。已落地的應用包括:基於 RAG 的 Colleague Knowledge Assistant 自 2025 年上線,已有超 1.6 萬名員工使用、處理超 100 萬次搜尋;全球市場業務用 Claude 每天處理約 12 萬封客戶郵件,進行分類、資訊補全和路由判斷。

r/LocalLLaMA top of the day10/2 22:49AI 評分27

開發者開源二戰主題小模型 Peacebell,291M 與 148M 兩版

開發者 Wayne Workman 用 11 個月業餘時間從零訓練了專注二戰資訊的小語言模型 Peacebell,已開源權重與訓練材料,含 291M 和 148M 兩個引數版本。148M 版是為參加 HuggingFace 限制 150M 以內模型規模的榜單而做,同時發布了 WWII 主題基準 ww2bench,題目不公開以防進入訓練資料。模型可在 CPU 上執行,作者提供了定製 vLLM fork,並稱其長上下文表現較差,下一版預計 2027 年發布。

r/ClaudeAI top of the day10/3 18:30AI 評分32

開發者用 Claude Code 做出意法跨境 3D 滑雪地圖

有人用 Claude Code 建置了義大利 La Thuile 滑雪場的 3D 地圖,該雪場跨邊境連線法國 La Rosière。資料指令碼用 Python 從 OpenStreetMap 下載雪道與纜車資料、從 AWS Terrain Tiles 獲取高程,最終打包成單個 0.8 MB 的 HTML 檔案,在手機和桌面瀏覽器中都能執行。作者還調侃說,除了建議先在黑道熱身之外,對結果相當滿意。

X @OpenAIDevs10/2 23:39AI 評分17

@OpenAIDevs

OpenAI 開發者帳號 @OpenAIDevs 在 2026 年 10 月 2 日發布了一條 X 帖子,正文只有一個指向 X 文章(x.com/i/article/2106076978206175232)的連結,沒有附帶任何文字說明。目前公開可見的資訊僅此一條連結,文章的具體內容、涉及的產品或發布時間均未在帖子正文中披露。

X @OpenAIDevs● 精選10/2 23:40AI 評分76

@OpenAIDevs: Your dot learns how you work, keeps context across apps, coordinates Codex tasks, and flags what ne…

OpenAI 開發者帳號發布 dot,它能學習使用者的工作方式、跨應用保留上下文、協調 Codex 任務,並標記需要使用者關注的事項。目前官方只給出這四項能力描述,未公布定價、可用平台與上線時間。

Cloudflare blog (AI)● 精選10/2 14:28AI 評分65

Cloudflare 在 AI Gateway 推出 Web Search API

Cloudflare 宣布與 Ceramic.ai、Exa、Linkup 三家搜尋服務商合作,在 AI Gateway 上推出 Web Search API,讓 agent 先搜尋再作答,而不是猜 URL 後 curl 出 404。開發者可通過標準 REST 介面呼叫,或在 Workers 裡用一行程式碼繫結,未來還將作為內建 Server Tools 提供。

Claude Platform release notes● 精選9/23 01:00AI 評分62

Claude API 快取診斷轉正,不再需要 beta header

Claude API 的快取診斷已結束 beta,正式可用,不再需要 cache-diagnosis-2026-04-07 這個 beta header。開發者只要在 Messages 請求里加上 diagnostics 物件即可啟用;仍傳送舊 header 的請求行為保持不變。POST /v1/messages 的回應現在總會包含 diagnostics 欄位,請求未帶 diagnostics 物件時該欄位為 null。

Ollama blog● 精選8/25 01:00AI 評分80

Ollama 支援作為閘道器接入 Claude Desktop

Ollama 現在可作為第三方閘道器接入 Claude Desktop,開發者在 Ollama 中開啟 Claude 開關即可自動完成配置。連線後可選任意 Ollama 模型,包括本地執行的開放模型與 Ollama 雲端模型,也能隨時切回 Anthropic 模型;在 Ollama 裡關閉 Claude 即恢復原有設定。

Latent Space● 精選9/30 23:23AI 評分81

OpenAI DevDay 發布 GPT-6.1 Sol、Dots 與 Agents API

OpenAI 在 DevDay 上發布 GPT-6.1 Sol、個人助理產品 Dots,以及內建 Computer Use 的 Agents API,開發者可基於與 Codex、ChatGPT 相同的 Computer Use 建置應用。Ari Weinstein 稱 GPT-6.1 Sol 成本是 Astra 的五分之一,用在 Computer Use 上只需七分之一。

Hacker News front page10/2 21:00AI 評分42

開源工具用 GPT-6 Astra 與 Opus 5.5 生成 LDraw 樂高模型

一位開發者發布了開源樂高 AI 生成器:一套 Python 工具、指令與文件,讓 AI agent 直接生成 LDraw 語言的樂高 CAD 模型。作者從去年 12 月開始試驗用 ChatGPT 和 Claude 寫 LDraw 程式碼,最終用 GPT-6 Astra 和 Opus 5.5 跑通,並打包成 Docker 化 Web 應用,可選 OpenAI、Claude、OpenRouter 三類提供方。

r/OpenAI top of the day10/3 06:38AI 評分42

為什麼嵌入模型常用 1536 維?

有開發者提問,為什麼嵌入模型常選 1536 維,而不是 1024 或 2048。OpenAI 使用過 1536 維嵌入,其他廠商也提供或推薦這一維度。提問者想知道這是 1024 與 2048 之間經驗性的折中點,還是存在架構或硬體上的便利原因,並希望有實際訓練或設計過嵌入模型的人回答。

Google AI blog● 精選10/2 16:00AI 評分68

Google 發布 Gemini 4 Argon,100 萬 token 輸出上限

Google 9 月發布新前沿模型 Gemini 4 Argon,擁有業界領先的 100 萬 token 輸出上限,面向編碼、網路安全防禦、金融研究與法律起草等重負載任務;目前僅通過 Fairwind Program 向受信任的網路安全防禦者開放,尚未放開給開發者、企業和消費者。

r/ClaudeAI top of the day10/3 03:26AI 評分65

Claude Code 通過 MCP 當上 RPG 遊戲主持人

開發者用 Claude Code 建置了 RPG 世界引擎 Chronicle,現在通過 MCP 讓 Claude Code 直接當遊戲主持人。在私人世界貼上一條 claude mcp add 命令並附帶 token,即可把 chronicle-storyteller 子代理裝進 ~/.claude/agents,之後由 Claude Code 接管回合;Chronicle 自身不呼叫模型,因此複用你已付費的 Claude 方案。

Google DeepMind blog● 精選9/30 21:01AI 評分83

Google 發布 Gemini 4 Argon,輸出上限提至 1M token

Google 於 2026 年 9 月 30 日發布新前沿模型 Gemini 4 Argon,先通過 Fairwind Program 向受信任的網路安全防禦方開放,之後再逐步提供給開發者、企業和消費者。它的輸出上限從 64K 提升到業界領先的 1M token,介紹價輸入每百萬 token 2 美元、輸出 10 美元,快取輸入享 95% 折扣。

r/LocalLLaMA top of the day10/3 21:03AI 評分5

新模型僅用笑話訓練,效果自帶笑點

有開發者發布了一個完全用笑話訓練的新模型,具體名稱、引數規模與訓練資料量均未披露。該帖由使用者 simonbreak 發布,正文只有一句“笑話自己會寫”,沒有給出下載地址、評測結果或使用方式。目前只能確認訓練語料限定為笑話,其他細節和限制未知。

Google Developers blog9/22 01:00AI 評分50

Google AI 訂閱開始附帶 Colab 高階加速器與 Ultra 後臺執行

2026 年 9 月 22 日起,Google AI 訂閱使用者在 Colab 中獲得高階權益:優先使用更快的加速器和更強的機器;Google AI Ultra 訂閱者還解鎖後臺不間斷執行和 Premium GPU 訪問,長時間訓練不必一直開著瀏覽器標籤。已有 Colab 訂閱內容不變,Google AI 訂閱權益可以疊加。

TechCrunch AI10/3 01:45AI 評分43

Meta 開源 Muse Gadgets,可自建硬體接入 Muse

Meta 推出開源專案 Muse Gadgets,開發者可用官方開源韌體和 Linux SDK 自製硬體連線其個人 AI 助手 Muse,支援樹莓派、ESP32 等開發板,接入螢幕、按鈕、感測器與執行器。Meta 還免費發放 5000 臺 Muse Home Link(USB-C 供電,讓 Muse 連線家庭網路並控制智慧音箱、電視),限 Muse 訂閱者先到先得,預計數週內發貨。

Gemini API release notes9/3 01:00AI 評分35

Google 將音樂生成模型 Lyria 3.5 正式開放

Google 於 2026 年 9 月 3 日把下一代音樂生成模型 lyria-3.5 轉為正式可用(GA)。它支援文字與影像輸入,可生成整首歌曲,音樂連貫性與人聲自然度提升,並支援對時長和結構的細粒度控制,輸出 44.1 kHz 立體聲。開發者可在 Gemini API 的 Music generation 指南中檢視詳情與程式碼範例。

r/LocalLLaMA top of the day10/3 07:13AI 評分73

gufo 分支讓 Qwen3.6 35B A3B 在 Strix Halo 上跑出 3095tok/s 預填充

開發者 nubela 發布了 gufo 的分支 gufo-Qwen3.6-35B-A3B-Q6dense,在 Strix Halo 上實現 3095 tok/s 預填充和 190 tok/s 解碼,目標是 3000 tok/s 預填充與 150 tok/s 解碼。該分支為追求速度而非智慧的負載設計,作者自行量化了模型並以 Apache 2.0 許可發布,使用 unsloth 的 GGUF 也可執行但效能較低。

NVIDIA blog● 精選10/2 00:44AI 評分86

OpenAI 上線 GPT-6 Astra Ultrafast,跑在 NVIDIA Blackwell 上

GPT-6 Astra Ultrafast 已上線,執行在 NVIDIA Blackwell GPU 上,面向 OpenAI 內部以及符合條件的 ChatGPT Work 和 Codex 使用者開放,token 生成速度最高可達 Astra Standard 模式的 8 倍。開發者今天就能通過 API 呼叫,接入方式、定價與實現細節見官方 Ultrafast 指南。更快的生成可縮短 coding agent 的編輯—測試—除錯迴圈,減少工具呼叫之間的等待時間。

r/OpenAI top of the day● 精選10/3 16:36AI 評分80

OpenAI 發布 GPT-6 系列模型指南

OpenAI 發布了 GPT-6 系列的模型指南,內容涵蓋模型選擇、推理強度(reasoning effort)與工具使用。該指南面向使用 GPT-6 系列的開發者,幫助其在具體場景中決定選哪個模型、投入多少推理算力以及如何呼叫工具。原文未披露具體模型型號、引數或發布時間等細節。

r/ClaudeAI top of the day10/3 18:19AI 評分75

LiveNerf 完成 Opus 5.5 十天基線測量

LiveNerf 專案已完成 Opus 5.5 的 10 天效能基線,從明天起將收集第 30 天的資料,之後可與基線對比,判斷模型發布後是否被降智。該專案由個人開發者發起,程式碼已開源在 GitHub,目標是獨立追蹤 Opus 5.5 的逐日表現。目前尚無結論性證據,作者稱希望藉此推動 AI 公司提高透明度。

Cloudflare blog (AI)10/2 14:00AI 評分38

Cloudflare 向 30 家非營利組織發放 750 萬美元 AI 額度

Cloudflare 公布首批非營利創業扶持計劃的 30 家入選組織,共獲得超過 750 萬美元開發者服務額度,每家最高 25 萬美元。這些組織用 Workers AI、AI Gateway 等建置自動化工具:LebTown 用自建編輯管理系統替代 Google Docs,Kaya Guides 的 WhatsApp 心理健康應用截至 2026 年 9 月已服務 10,439 人、每月處理約 50 萬條訊息。

TechCrunch AI10/2 19:11AI 評分67

Apple 收緊 macOS Full Disk Access 權限,應對 AI agent 風險

Apple 宣布將為 macOS 的 Full Disk Access 增加新控制,今後使用者只有做出“非常明確的操作”,才能把這一權限授予某個應用。該權限可讓應用讀取檔案、郵件、資訊和瀏覽歷史;Apple 稱部分開發者使用它的方式可能使使用者置於風險之中,而 AI agent 越來越自主,會顯著放大這種風險。此前 Inc.

Ars Technica AI● 精選10/3 00:03AI 評分78

蘋果收緊 macOS 完整磁碟取用權限,防 AI agent 濫用

蘋果宣布調整 macOS 隱私設定,阻止第三方應用開發者濫用權限讀取資訊記錄。此前有專欄作家稱 Meta 的通用 AI agent Muse 未經授權就推送了涉及他與同事 Apple Messages 對話的通知,引發大量使用者共鳴。Meta CTO 回應稱,Muse 要讀取 Apple Messages 需使用者手動授予完整磁碟取用權限並在 Muse 中開啟 Messages 聯結器。

r/LocalLLaMA top of the day10/3 18:01AI 評分65

MIT 許可原生代碼圖譜工具 repopedia 發布

開發者發布 repopedia,一個 MIT 許可的原生代碼知識圖譜工具,pip 安裝後即可在倉庫上執行,用 tree-sitter 解析並生成 SQLite 圖譜檔案,無需伺服器、Docker 或 API key,程式碼不上傳雲端。它支援查詢函式呼叫者與改動影響範圍,並可通過 MCP server 讓 Claude Code 直接查圖譜,一次拿到帶 file:line 的精確答案,而非多輪 grep。

r/LocalLLaMA top of the day● 精選10/2 21:16AI 評分80

微軟發布 4B 智慧體模型 FrogNano,主打倉庫級編碼

微軟發布 FrogNano-4B-2609,一個面向算力有限開發者的 4B 智慧體模型,Hugging Face 上已有 GGUF 量化版本。它由 Qwen3.5-4B 派生,沿用 32 層混合 Gated DeltaNet 與門控注意力架構,後訓練為純文字、聚焦倉庫級軟體工程,用強化學習在約 1500 個 TaskPilot 生成的合成 SWE 環境上訓練,獎勵來自可執行測試,配套五工具的 Leaf harness。與行為蒸餾不同,它不訓練強模型的解題軌跡。

Hacker News front page10/3 23:22AI 評分45

作者稱手寫程式碼時代已終結,Claude Code 讓 18 年習慣消失

一位寫了 18 年程式碼的工程師表示,自 Claude Code 中的 Opus 4.5 越過某個門檻後,他幾乎不再手寫程式碼,並認為回不去了。他所在團隊 Filestage 每月合併 PR 從約 200 增至 300,bug 報告未增加,每位開發者每月 AI 訂閱費 20 美元,工具可自選 Codex、Claude Code 或 Cursor。他仍主張保留高階抽象,認為 LLM 應生成高階表示再交給確定性編譯器,而非直接寫彙編。

Latent Space● 精選10/1 07:45AI 評分84

Gemini 4 Argon 發布,輸出上限 100 萬 token,僅限安全預覽

Google DeepMind 發布 Gemini 4 Argon,首次支援最高 100 萬 token 輸出,但目前僅在 Fairwind 計劃下對政府使用者與受信任網路安全人員開放預覽,開發者、企業與消費者開放時間未定。標準價 $4/$20 每百萬輸入/輸出 token,首推五折 $2/$10,快取輸入 95% 折扣;19 項公開基準中拿下 13 項第一。100 萬輸出靠新 API 功能 Long Decode Continuation 實現,長回覆會暫停並跨呼叫續寫;

Google Developers blog10/2 22:21AI 評分45

TPU 上最佳化稀疏注意力,1440p 影片生成推理提速 1.69 倍

開發者用 Sparse VideoGen(SVG)把注意力頭動態路由到高度結構化的空間或時間稀疏掩碼,並在 TPU 上最佳化 Splash Attention 核心,使 1440p 影片生成的端到端推理最高提速 1.69 倍。核心側的具體改動是:跳過空記憶體 tile、把精確座標掩碼嚴格限制在邊界 tile、將 token 記憶體佈局改成時間優先(temporal-major)以獲得連續訪問。目的是把演算法層的稀疏真正對齊到硬體 tile 執行,顯著減少被浪費的矩陣運算。

Hacker News front page● 精選10/2 20:37AI 評分76

蘋果收緊 macOS 完全磁碟存取權限

蘋果宣布將在 macOS 中為完全磁碟訪問(Full Disk Access)引入額外管控,使用者今後必須通過非常明確的主動操作才能把這一權限授予某個 App。蘋果稱部分開發者濫用該權限,可能暴露使用者系統上的檔案、郵件、資訊和瀏覽歷史,對通訊類 App 還會危及通訊對方的隱私。蘋果特別提到,隨著 AI agent 能力與自主性增強,這類訪問帶來的風險會顯著上升,因此要讓使用者在授權前清楚瞭解風險。具體生效時間與實現方式尚未公布。