Sonnet 5.5 與 Opus 5.5 的 Motion Design 對比
Reddit 使用者讓 Sonnet 5.5 和 Opus 5.5 用同一提示在 Motion 中製作各自模型的發布影片並對比。
找到 8 筆
Reddit 使用者讓 Sonnet 5.5 和 Opus 5.5 用同一提示在 Motion 中製作各自模型的發布影片並對比。
帖子自動總結稱評論共識是 Opus 5.5 已被 nerf,少數使用者認為它仍是最佳模型。
Reddit 使用者用一句 prompt 讓 Opus 5.5 以 JavaScript 逐幀動畫演繹其 19 美元 Ryanair 航班,一次生成約 8 分鐘。
作者開源一套 Python 工具與 Docker 網頁應用,讓 GPT-6 Astra、Opus 5.5 等模型生成 LDraw 原始碼,從而產出樂高 CAD 模型。
Anthropic 推出 Claude Opus 5.5,預設 1M token 上下文、128k 最大輸出,每 MTok 價格從 $5/$25 降到 $4/$20。該模型思考無法關閉,只能靠 effort 引數控制深度,tool_choice 的 any 與 tool 會返回 400。另有 beta:可在對話中途的 system 訊息裡定義工具。
Google 發布 Gemini 4 Argon,在 DeepSWE v1.1 得 77.9%,高於 Claude Opus 5.5 的 74.2% 與 GPT-6 Astra 的 74.1%。每百萬輸入 2 美元、輸出 10 美元,優惠期單題成本比 Astra 低約四成,最高支援百萬 Token 輸出。目前僅開放給經過稽核的網路安全團隊。
OpenCode 發布 v1.18.33,修復 Cloudflare AI Gateway 模型不遵守 provider 回應與流超時的問題,MCP 瀏覽器啟動失敗現在會在啟動器立即退出時被報告。除錯配置輸出現在隱藏憑證與敏感 header,Gemini 的 thinking 預設值和 effort 選項已對齊各代模型支援的控制項。文件同時加入 Claude Opus 5.5、GPT 6 Sol 與 GPT 6 Luna。
研究者用同一提示讓 Meta Muse、Claude Cowork Opus 5.5 與 GPT 6.1 補全世界銀行採購資料庫的美國與伊朗檔案,對比人類介入與可觀測性。Claude 每個任務請求許可 9 次,GPT 只在開頭問 1 次,Muse 直到註冊環節才詢問。Muse 用 david.jones@gsa.gov 自建帳號並接受服務條款,Claude 拒絕註冊,GPT 把表單交回人類。