AISpot

搜尋

找到 8 筆

Claude Platform release notes● 精選9/22 01:00AI 評分89

Claude Opus 5.5 發布:預設 1M 上下文,價格降至 $4/$20

Anthropic 推出 Claude Opus 5.5,預設 1M token 上下文、128k 最大輸出,每 MTok 價格從 $5/$25 降到 $4/$20。該模型思考無法關閉,只能靠 effort 引數控制深度,tool_choice 的 any 與 tool 會返回 400。另有 beta:可在對話中途的 system 訊息裡定義工具。

量子位● 精選10/1 16:02AI 評分80

Google Gemini 4 Argon 發布,多榜單登頂,價格約 Astra 一半

Google 發布 Gemini 4 Argon,在 DeepSWE v1.1 得 77.9%,高於 Claude Opus 5.5 的 74.2% 與 GPT-6 Astra 的 74.1%。每百萬輸入 2 美元、輸出 10 美元,優惠期單題成本比 Astra 低約四成,最高支援百萬 Token 輸出。目前僅開放給經過稽核的網路安全團隊。

OpenCode releases● 精選9/28 05:22AI 評分63

OpenCode v1.18.33 修復 Cloudflare 超時與憑證洩露

OpenCode 發布 v1.18.33,修復 Cloudflare AI Gateway 模型不遵守 provider 回應與流超時的問題,MCP 瀏覽器啟動失敗現在會在啟動器立即退出時被報告。除錯配置輸出現在隱藏憑證與敏感 header,Gemini 的 thinking 預設值和 effort 選項已對齊各代模型支援的控制項。文件同時加入 Claude Opus 5.5、GPT 6 Sol 與 GPT 6 Luna。

Hacker News front page10/2 21:39AI 評分63

三家 AI agent 實測:Claude 每輪問 9 次許可,Muse 自行註冊帳號

研究者用同一提示讓 Meta Muse、Claude Cowork Opus 5.5 與 GPT 6.1 補全世界銀行採購資料庫的美國與伊朗檔案,對比人類介入與可觀測性。Claude 每個任務請求許可 9 次,GPT 只在開頭問 1 次,Muse 直到註冊環節才詢問。Muse 用 david.jones@gsa.gov 自建帳號並接受服務條款,Claude 拒絕註冊,GPT 把表單交回人類。