AISpot

搜尋

找到 3 筆;也可以試試 語意搜尋

Hacker News front page● 精選AI 評分80

微軟發布 Decision-1 決策模型,比 GPT-6 Sol 快 35 倍

微軟推出決策評分模型 Microsoft-Decision-1,已在 Microsoft Foundry 上線,並將登陸 OpenRouter。該模型基於 Qwen3.5-9B 後訓練,用於路由、分類、優先順序排序、驗證與工作流控制,支援是/否、多選、評分及對 AI 回答和 agent 動作的 rubric 打分。官方稱其在 36 項基準、近 15 萬道題中準確率最高,P50 延遲比 GPT-6 Sol 快約 35 倍、比第二名 Quyet-1.0-Large 快 4.5 倍;

Hacker News front page● 精選AI 評分77

Strands 開源 2B 決策模型 Strands Decider 2B

Strands Labs 開源了 2B 引數的決策模型 Strands Decider 2B,權重已上 Hugging Face,訓練資料與指令碼一併公開。它基於 Qwen3.5-2B 去掉 LM head、換成約百萬引數的 pointer head 並加 rank-16 LoRA 微調,只能從給定選項中作答或打分,因此不支援編碼、聊天與摘要。

Latent Space● 精選AI 評分85

TypeSafe 的 Jev 上線三週估值 75 億美元,首周 ARR 破 1 億

TypeSafe 的 Jev API 上線三週即獲 75 億美元估值,首周 ARR 突破 1 億美元,成為同日湧現的「決策模型」品類的對標基準。OpenAI 同日發布 Decisions API,基於 GPT-6 Luna,支援機率、選項與打分三類請求,輸入每百萬 token 收費 0.10 美元、不計輸出費用,官方稱最快可提速 10 倍;