AISpot

GLM

10月3日星期六 · 3 則

  1. r/LocalLLaMA top of the dayAI 評分33

    新模型寫作風格趨向高資訊密度與生僻詞彙

    有使用者觀察到,近期開源與閉源模型(如 GLM 5.3 Flash)的寫作風格正趨向高資訊密度和更豐富的詞彙,用更少的詞表達更多內容,類似 William Gibson 的壓縮文風。作者認為這可能與 token 效率最佳化有關,但代價是普通讀者難以一眼讀懂,例如模型會使用 Baudrillardian 這類生僻詞。

  2. r/LocalLLaMA top of the dayAI 評分32

    LocalLLaMA 網友曬本地跑模型硬體方案

    r/LocalLLaMA 使用者 pmarsh 發帖稱自己已接近本地推理硬體投入的中間水平,評論區隨即給出多種低成本方案:2014 至 2018 年的 2 至 4 路 DDR3 CPU 伺服器可跑 qwen 3.8 flash 超 15 tok/s;雙 7900XTX 不到 2000 美元可跑 27B Q8 超 220k 上下文;CMP 170HX 視訊記憶體超頻可達 2TB/s,單流解碼約 60 tok/s。

10月1日星期四 · 1 則

  1. NVIDIA blogAI 評分22

    NVIDIA 提出 AI 工廠回報三要素,稱 Vera Rubin 每兆瓦吞吐超 GB300 30 倍

    NVIDIA 提出衡量 AI 工廠投資回報的三個變數:產能(每兆瓦吞吐與每 token 成本)、使用壽命和需求。它援引 SemiAnalysis AgentX 資料稱,Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 上每百萬 token 成本最多低 45 倍;每兆瓦 AI 工廠造價約 6000 萬美元。

9月29日星期二 · 2 則

  1. Simon Willison● 精選AI 評分73

    Anthropic 紅隊:GLM-5.3 在 4% 任務中實現控制流劫持

    Anthropic Frontier Red Team 在內部 Binary Exploitation 基準中隨機抽取 100 個任務評估多個模型:GLM-5.3 在 4% 的試驗裡實現了完整控制流劫持,Claude Mythos Preview 為 6%。此前模型 Claude Opus 4.6 與 GLM-5.2 在這些任務中一次都沒有成功。該團隊認為,GLM-5.3 的成績雖低於 Claude Mythos Preview,但一個有意義的能力門檻已被跨過。

  2. Anthropic Research● 精選AI 評分81

    GLM-5.3 可自主建置端到端漏洞利用,防護易被繞過

    智譜 AI(海外稱 Z.ai)的 GLM-5.3 具備自主建置端到端網路漏洞利用的能力,且發布時未設有效防護,Anthropic 測試顯示攻擊者用簡單技巧即可在 64% 到 100% 的情況下繞過其防護。在 ExploitBench 上,GLM-5.3 於 410 次嘗試中成功開發出 50 次端到端利用,接近 Claude Mythos Preview 的 56 次;在內部二進位制利用基準中取得 4% 的完整控制流劫持,Claude Mythos Preview 為 6%。

9月17日星期四 · 1 則

  1. X @Zai_orgAI 評分58

    智譜稱 GLM-5.3 兩週內自建推理基礎設施

    智譜分享 GLM-5.3 如何幫助建置並最佳化服務 GLM-5.3-Flash 的推理基礎設施,系統從首次跑通到可上生產不到兩週,端到端吞吐量達到初始基線的 3 倍。關鍵在於密集反饋:本地正確性測試、執行軌跡、微基準與端到端測量,讓團隊做有針對性的假設驗證,而不是隻看聚合效能指標。

9月1日星期二 · 1 則

8月28日星期五 · 1 則

8月27日星期四 · 1 則

7月21日星期二 · 1 則

2月12日星期四 · 1 則

  1. MLX LM releases● 精選AI 評分84

    v0.30.7 發布:修復 Kimi Linear、DeepSeek V3.2,新增 GLM5 與 Qwen3.5

    2026 年 2 月 12 日發布的 v0.30.7 修復了 Kimi Linear 與 DeepSeek V3.2 的 indexer 和權重載入問題,並加快 DSV32 生成速度。這一版新增 GLM5、不含視覺能力的 Qwen3.5 系列與 LongCat MLA 支援,LFM2 模型可用 Pythonic 方式呼叫工具,另加入 Mistral 工具解析器。訓練流程中的驗證集改為可選,還有一項為下一版本提號的版本號變更。

2月4日星期三 · 1 則