GLM-5.3 上線 Amazon Bedrock
@Zai_org 宣布 GLM-5.3 已在 Amazon Bedrock 上線,企業使用者可通過該平台呼叫。官方稱其為企業帶來更強的程式設計與 agentic 能力,並附上 AWS 文件中的模型卡連結作為接入入口。除上線渠道與能力定位外,本次未披露定價、上下文長度、可用區域等細節。
官方確認 GLM-5.3 進入 Amazon Bedrock 模型目錄,為在 AWS 上建置程式設計與智慧體應用的企業提供了新的可選模型。
原標題:@Zai_org: GLM-5.3 is now available on Amazon Bedrock.
閱讀原文
| 評分 | 66 / 60(平均 63,門檻 60) |
|---|---|
| 狀態 | 精選 |
相關報導
llama.cpp v0.6.0 發布:新增擴充套件 batch API 與 GLM-5.3-Flash 支援
llama.cpp 發布 v0.6.0,新增 llama_batch_ext 擴充套件 batch API,支援混合 token/embedding 輸入與 MTP、deepstack 狀態嵌入。本次加入 320B 的 GLM-5.3-Flash(GLM5-Next)文字+視覺混合模型、Clef 決策模型,以及 Qwen4Exp 的 MTP 投機解碼,官方稱在 DGX Spark 上解碼約快 1.5 倍。
llama.cpp 發布 b11352 版本,最佳化 Qwen4 掩碼構造
llama.cpp 發布 b11352 建置版本,主要變更為最佳化 Qwen4 的掩碼構造(#29824),並將相同改動應用到 GLM5-next。該版本覆蓋 macOS、iOS、Linux、Android、Windows 與 openEuler 平台,提供 CPU、Vulkan、CUDA 12/13、ROCm 10.0、OpenVINO、SYCL 等多種後端建置,其中 macOS Apple Silicon 的 KleidiAI 建置被標記為 DISABLED。
Google 發布 Gemini 4 Argon 等 9 月 AI 更新
Google 在 9 月發布新一代前沿模型 Gemini 4 Argon,具備先進推理能力與 100 萬 token 輸出上限,目前通過 Fairwind Program 向受信任的網路安全防禦方分階段開放。
llama.cpp 新增 Decision 模型支援
llama.cpp 最新建置已加入 Decision 模型支援,新增 /v1/systemone 端點,可在本地進行 Jev 風格推理,兼顧效率與隱私。目前支援多個開源模型,官方表示後續還會增加更多模型。
Ollama v0.40.0:Apple Silicon 預設用 MLX 跑模型
Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構將自動改用 MLX 執行。官方範例為 ollama pull qwen3.8 與 ollama run qwen3.8;預發布期間會繼續測試並啟用更多模型。