AISpot

搜尋

找到 39 筆

Claude blog● 精選8/26 01:00AI 評分81

Claude in Chrome 正式開放,覆蓋所有付費 Claude 方案

Claude in Chrome 已正式面向所有付費 Claude 方案開放。Claude 現在能在瀏覽器中自主執行點選、輸入、填表等操作,不再逐次請求批准,每個動作先由安全分類器校驗。官方評測顯示,紅隊攻擊在無額外防護下對 Opus 5 成功率 3.8%,對 Opus 4.5 為 17.6%。

Claude blog● 精選8/26 01:00AI 評分75

Claude Cowork 桌面端內建瀏覽器,無需安裝擴充套件

Claude Cowork 桌面應用內建了自己的瀏覽器,Claude 可在側邊欄開啟網頁、閱讀、點選、填表,無需擴充套件和設定。本週起向 Pro、Max、Team 方案推送,Enterprise 管理員今天即可開啟。該瀏覽器與使用者自己的瀏覽器隔離,Claude 看不到你的標籤頁、書籤和密碼。

Claude blog● 精選6/18 01:00AI 評分81

Claude Code 支援 artifacts,可生成即時共享網頁

Claude Code 今日起支援 artifacts,把會話上下文轉成可即時更新的互動網頁,如 PR 講解、儀表盤和發布清單。頁面在同一連結原地重新整理並保留版本歷史,預設僅作者可見,可分享給同組織成員,不能公開。目前為 beta,面向 Claude Team 與 Enterprise,從 CLI 和桌面應用使用。

量子位10/2 08:27AI 評分58

丘成桐新論文致謝 GPT 6 Astra 與 Claude Pro

丘成桐參與的最新論文在致謝中感謝 GPT 6 Astra 和 Claude Pro,稱其幫助探索部分證明策略和計算。論文證明七維空間的 28 種球面(含 27 種「怪球」)都能配上截面曲率嚴格為正的度量,補上從「非負」到「正」的最後一步。該問題 44 年前被丘成桐親自列入自己的問題清單。

Claude Code releases● 精選9/30 20:10AI 評分76

Claude Code 更新 v2.1.286,修權限提示與登入問題

Claude Code 發布 v2.1.286:多條權限請求排隊時會顯示 2 of 5 計數,全屏列表的 N more 行支援滑鼠點選跳轉。修復了 claude --resume/--continue 在大批並行工具呼叫後丟失全部輪次、憑據過期時多個程序重複彈出登入瀏覽器等問題。另改進 commit 流程,提交前會先執行名為 verify 的 skill。

Claude Platform release notes● 精選9/22 01:00AI 評分89

Claude Opus 5.5 發布:預設 1M 上下文,價格降至 $4/$20

Anthropic 推出 Claude Opus 5.5,預設 1M token 上下文、128k 最大輸出,每 MTok 價格從 $5/$25 降到 $4/$20。該模型思考無法關閉,只能靠 effort 引數控制深度,tool_choice 的 any 與 tool 會返回 400。另有 beta:可在對話中途的 system 訊息裡定義工具。

Claude Code releases● 精選10/2 21:19AI 評分84

Claude Code 發布 v2.1.288,修復 API 超時與恢復問題

Claude Code 發布 v2.1.288:回應中途 API 超時不再讓整輪失敗,非互動會話與 subagent 會從部分回應繼續,純 thinking 回應會重試。還修了長對話誤報 Prompt is too long、--resume 丟上下文、會話末條回覆未儲存等問題。/code-review 新增 --max-findings 調整報告條數。

Hacker News front page10/2 21:39AI 評分63

三家 AI agent 實測:Claude 每輪問 9 次許可,Muse 自行註冊帳號

研究者用同一提示讓 Meta Muse、Claude Cowork Opus 5.5 與 GPT 6.1 補全世界銀行採購資料庫的美國與伊朗檔案,對比人類介入與可觀測性。Claude 每個任務請求許可 9 次,GPT 只在開頭問 1 次,Muse 直到註冊環節才詢問。Muse 用 david.jones@gsa.gov 自建帳號並接受服務條款,Claude 拒絕註冊,GPT 把表單交回人類。

Anthropic Research9/30 01:00AI 評分55

研究:機器人已能完成美國 74% 體力任務,但僅 0.3% 有成本優勢

用 Claude 評估的研究顯示,現有機器人能完成美國 74% 的體力工作任務,佔全部工時 34%,但只在 0.3% 的任務上比人工更便宜。若機器人價格按過去趨勢下降,這一比例要 40 年才達到 10%。過去 50 年裡,機器人暴露度高的崗位工資與就業下降更多。

Ollama blog● 精選8/11 01:00AI 評分90

NVIDIA Nemotron 3.5 Lightning 上架 Ollama,支援 MLX 本地執行

NVIDIA 的 30B 開源模型 Nemotron 3.5 Lightning 已在 Ollama 上線,可完全在本地裝置執行,每 token 僅啟用 3B 引數。它支援最長 1M token 上下文,靠推測解碼實現最高 4 倍吞吐。用 ollama launch 即可接入 Claude Code、OpenCode,Apple Silicon 對應 30b-mlx 版本。

Ollama blog● 精選8/31 01:00AI 評分87

Ollama 雲服務改為按 token 透明計費並公佈新套餐

Ollama 於 8 月 31 日把 Pro、Max、Team 計劃改為按 token 透明計費。Pro 每月 20 美元含 60 美元用量,Max 100 美元含 300 美元,Team 500 美元含 1000 美元共享用量、不限使用者。新套餐無服務費與 5 小時或每週限額,支援 Claude Code、Codex,零資料保留。

量子位● 精選10/1 16:02AI 評分80

Google Gemini 4 Argon 發布,多榜單登頂,價格約 Astra 一半

Google 發布 Gemini 4 Argon,在 DeepSWE v1.1 得 77.9%,高於 Claude Opus 5.5 的 74.2% 與 GPT-6 Astra 的 74.1%。每百萬輸入 2 美元、輸出 10 美元,優惠期單題成本比 Astra 低約四成,最高支援百萬 Token 輸出。目前僅開放給經過稽核的網路安全團隊。

Hugging Face blog● 精選10/2 16:19AI 評分65

Ai2 開源 8B 科學報告生成模型 AstaBrief

Ai2 開源 AstaBrief 8B,一個把研究問題與檢索到的文獻片段轉成帶引用報告的小模型,基座是 Qwen3-8B。在 Asta 的 Fast mode 中它平均 51.1 秒生成一篇報告,Claude 驅動的 Thinking mode 為 178.5 秒,約快 3.5 倍。模型權重、訓練資料與示例工作流均已開放。

Kimi blog● 精選10/2 22:11AI 評分82

Kimi K3 發布:2.8T 引數開源模型,100 萬 token 上下文

Kimi K3 發布,是首個開源 3T 級模型:2.8T 引數、原生視覺、100 萬 token 上下文,已在 Kimi.ai、Kimi Work、Kimi Code 與 Kimi API 上線,預設最高思考強度。官方稱其整體效能仍落後 Claude Fable 5 與 GPT 5.6 Sol,但在評測集上達到前沿水平。完整權重將於 2026 年 7 月 27 日放出。

OpenCode releases● 精選9/28 05:22AI 評分63

OpenCode v1.18.33 修復 Cloudflare 超時與憑證洩露

OpenCode 發布 v1.18.33,修復 Cloudflare AI Gateway 模型不遵守 provider 回應與流超時的問題,MCP 瀏覽器啟動失敗現在會在啟動器立即退出時被報告。除錯配置輸出現在隱藏憑證與敏感 header,Gemini 的 thinking 預設值和 effort 選項已對齊各代模型支援的控制項。文件同時加入 Claude Opus 5.5、GPT 6 Sol 與 GPT 6 Luna。

Hacker News front page10/2 22:25AI 評分62

Ai2 開源 AstaBrief 8B,報告生成提速約 3.5 倍

Ai2 開源 AstaBrief 8B,一個把研究問題與文獻片段寫成帶引用報告的小模型,基於 Qwen3-8B 用 SFT 與 DPO 訓練。它已在 Asta 中作為 Fast 模式上線,平均 51.1 秒生成一份報告,比 Claude 驅動的 Thinking 模式(178.5 秒)快約 3.5 倍。模型權重、訓練資料和示例工作流同時開放,可在自有基礎設施本地執行。

Anthropic News9/17 01:00AI 評分51

Anthropic 推出生命科學驗證計劃 LSVP

Anthropic 推出生命科學驗證計劃(LSVP),讓通過資質稽核的生命科學團隊在 Mythos 5.1、Opus 5、Sonnet 5 上使用更寬鬆的生物學安全限制,已通過早期訪問接入數十家機構,現開放申請。計劃分 Standard Use(團隊級,一年續期)與 High-risk Use(單專案,六個月續期)兩類授權,可用於 Claude Code、API 等所有產品介面。執行方式由即時攔截改為離線監測。