AISpot

搜尋

找到 8 筆

Mistral AI news● 精選5/27 01:00AI 評分78

Mistral 發布 Agents API,內建聯結器與持久記憶

Mistral AI 發布 Agents API,在 Chat Completion API 之外提供專門的 agent 框架。該 API 內建程式碼執行、網頁搜尋、影像生成(由 Black Forest Lab FLUX1.1 [pro] Ultra 驅動)、文件庫 RAG 與 MCP 工具等聯結器,並支援跨對話持久記憶、有狀態會話、流式輸出和多 agent 編排。開發者可通過指定 agent_id 或直接指定模型發起會話,並隨時續接或從任一節點新建分支。

Hacker News front page● 精選10/6 14:06AI 評分91

Mistral Large 4 發布:1T 引數原生多模態,API 今日可用

Mistral AI 發布 Mistral Large 4(代號 Le Chonk),總引數 1T、啟用 49B,原生多模態,即日起通過 API 向所有人開放,開放權重版本將於 10 月底發布。官方稱其是歐美聚合基準上最好的開放權重模型,在網路安全、製造、金融等關鍵負載上達到 SOTA,視覺 grounding 超過閉源前沿模型。該模型端到端在歐洲打造,可通過 Mistral 自有的 Mistral Cloud 基礎設施部署,目前正與網路安全夥伴私下合作。

Simon Willison● 精選10/6 21:18AI 評分84

Mistral 發布 1 萬億引數 Mistral Large 4 預覽版

Mistral 放出 Mistral Large 4 預覽版:1 萬億總引數、490 億啟用引數,在自建 3800 塊 NVIDIA Grace Blackwell GPU 叢集上訓練。預覽版目前只通過 Mistral API 提供,官方承諾月底發布開放權重版本。該 API 僅支援 none 和 high 兩檔推理等級,high 檔生成同樣題目時用了 2717 個輸出 token,反而少於 none 檔的 3275。

X @MistralAI● 精選10/6 14:06AI 評分91

Mistral 發布 Large 4:1T 引數原生多模態,API 已上線

Mistral 推出 Mistral Large 4(代號 Le Chonk),1T 總引數、49B 啟用,原生多模態,即日起通過 API 向所有人開放。官方稱其是美國和歐洲聚合基準上表現最好的開放權重模型,在網路防禦、製造與金融等關鍵負載上達到 SOTA,視覺 grounding 超過閉源前沿模型。模型在歐洲端到端打造,可通過 Mistral Cloud 在歐洲部署,正與網路安全夥伴私下合作;開放權重將於 10 月底發布。

Hacker News front page● 精選10/6 14:25AI 評分92

Mistral 發布 Mistral Large 4 預覽,權重月底開放

Mistral 於 10 月 6 日開啟 Mistral Large 4 公開預覽,可在 Mistral Studio 呼叫 API,權重本月底放出。模型為 1 萬億引數原生多模態、49B 啟用引數,在歐洲自有資料中心用 3800 張 NVIDIA Grace Blackwell GPU 從零訓練。官方稱其在 Artificial Analysis Cyber Index 位列全球前五,漏洞復現並修補測試得 82% 為所有模型最高,Cybench 解決 93%;

Hacker News front page● 精選10/6 14:15AI 評分91

Mistral Large 4 發布:1.05T 引數開放權重多模態模型

Mistral 於 10 月 6 日公開預覽 Mistral Large 4:開放權重、通用多模態模型,採用細粒度 MoE 架構,49B 啟用引數、1.05T 總引數,配 1.6B 視覺編碼器,上下文 1M。定價為輸入每百萬 tokens 0.68 美元、快取輸入 0.07 美元、輸出 2.09 美元,頁面同時列出 1.36、0.14、4.18 的對照價格。功能含結構化輸出、函式呼叫、文件問答、字首補全、Chat Completions、批處理與 Agents 內建工具。

Mistral AI news● 精選5/28 01:00AI 評分79

Mistral 發布首個程式碼專用嵌入模型 Codestral Embed

Mistral AI 發布首個程式碼專用嵌入模型 Codestral Embed,主打真實程式碼資料的檢索場景,稱其表現顯著超過 Voyage Code 3、Cohere Embed v4.0 與 OpenAI 的大型嵌入模型。模型支援輸出不同維度與精度,256 維 int8 版本仍優於競品全部模型;維度按相關性排序,可擷取前 n 維以權衡品質與成本。