AISpot

Apple

近期事件

  1. 1
    熱度 1.44 個來源 · 4 則10/3 00:03

10月3日星期六 · 6 則

  1. r/OpenAI top of the dayAI 評分50

    ChatGPT macOS 桌面版 PDF 附件訪問 Bug 復現求助

    有使用者在 macOS 版 ChatGPT 桌面應用(版本 26.930.31730,Apple Silicon)遇到 PDF 附件訪問異常:同一 PDF 用“On the computer”可讀,用“Run on the cloud”卻取不到;把會話移入專案後,通過上傳 ID 下載 PDF 報“file could not be authorized or resolved”,本地附件目錄仍可正常讀取並提取兩頁,且所選專案與活動工作區目錄不一致。

  2. r/LocalLLaMA top of the dayAI 評分49

    開發者發布 Ninfer 4080,16GB 顯示卡可跑 100k 上下文

    開發者 roofkid 發布 Ninfer 4080,讓 RTX 4080 16GB 顯示卡以 100k 上下文執行 ISTA-DASLab-Qwen-3.8-27B-GSQ,最高預填充 2720 tok/s、生成 262 tok/s,程式碼已在 GitHub 開源並提供 Docker 映象。它採用 DFlash2 投機解碼,作者稱預填充與生成速度明顯優於 llama.cpp、vllm 等通用推理引擎,代價是 KV 量化帶來輕微精度損失。

  3. Hacker News front pageAI 評分65

    Vx 發布:把 CPU、GPU、NPU 記憶體寫進型別系統的語言

    Vx 是一門面向異構計算的系統程式語言,把 CPU、GPU、NPU 與加速器記憶體納入型別系統,主機執行緒解引用裝置指標會直接編譯報錯。它要求跨記憶體空間顯式呼叫 transfer(),並用機器檔案描述 H100、H200、B200、A100、MI300X、Apple M4 等真實硬體的記憶體層級與互連,編譯期校驗放置是否可行。

  4. Hacker News front pageAI 評分37

    Cloudflare 推出 OHTTP Gateway 自服務測試版

    Cloudflare 今年秋季推出 OHTTP Gateway,作為付費附加元件讓客戶在自有域名上接收 OHTTP 流量,現已開放等待名單。OHTTP 通過中繼與閘道器兩跳分離,使應用後端看不到使用者 IP;此前已用 Cloudflare 保護伺服器的客戶無法使用其 OHTTP Relay,現在可改用第三方中繼加 Cloudflare 閘道器。閘道器執行在 Cloudflare 全球邊緣網路,可減少中繼到閘道器及閘道器到源的延遲。

  5. Ars Technica AI● 精選AI 評分78

    蘋果收緊 macOS 完整磁碟取用權限,防 AI agent 濫用

    蘋果宣布調整 macOS 隱私設定,阻止第三方應用開發者濫用權限讀取資訊記錄。此前有專欄作家稱 Meta 的通用 AI agent Muse 未經授權就推送了涉及他與同事 Apple Messages 對話的通知,引發大量使用者共鳴。Meta CTO 回應稱,Muse 要讀取 Apple Messages 需使用者手動授予完整磁碟取用權限並在 Muse 中開啟 Messages 聯結器。

10月2日星期五 · 4 則

  1. The Verge AI● 精選AI 評分80

    Apple 將限制 Mac 完整磁碟取用權限,應對 AI 代理風險

    Apple 於週五宣布將在 Mac 上對「完整磁碟取用」(full disk access)增加新的限制與控制,要求真正想授予應用這一級別權限的使用者「必須通過非常明確的動作」才能完成授權,理由是 AI 代理帶來的風險大幅上升。此事發生前幾週,Inc 的 Jason Aten 發現 Meta 的 Muse AI 在未獲明確授權的情況下知道了他訊息的內容;Meta 發言人 Andy Stone 回應稱訊息訪問完全基於使用者主動選擇加入。

  2. Hacker News front page● 精選AI 評分76

    蘋果收緊 macOS 完全磁碟存取權限

    蘋果宣布將在 macOS 中為完全磁碟訪問(Full Disk Access)引入額外管控,使用者今後必須通過非常明確的主動操作才能把這一權限授予某個 App。蘋果稱部分開發者濫用該權限,可能暴露使用者系統上的檔案、郵件、資訊和瀏覽歷史,對通訊類 App 還會危及通訊對方的隱私。蘋果特別提到,隨著 AI agent 能力與自主性增強,這類訪問帶來的風險會顯著上升,因此要讓使用者在授權前清楚瞭解風險。具體生效時間與實現方式尚未公布。

  3. TechCrunch AIAI 評分67

    Apple 收緊 macOS Full Disk Access 權限,應對 AI agent 風險

    Apple 宣布將為 macOS 的 Full Disk Access 增加新控制,今後使用者只有做出“非常明確的操作”,才能把這一權限授予某個應用。該權限可讓應用讀取檔案、郵件、資訊和瀏覽歷史;Apple 稱部分開發者使用它的方式可能使使用者置於風險之中,而 AI agent 越來越自主,會顯著放大這種風險。此前 Inc.

9月29日星期二 · 2 則

  1. MLX releases● 精選AI 評分70

    v0.32.3

    MLX 發布 v0.32.3,一批修復覆蓋 Metal、CUDA 與 CPU 後端,並新增面向 M5 的非量化 matmul 調優。Metal 側加入 gated delta nets 核心與 fast.cross_entropy 融合核心,降低 SDPA D256/D512 記憶體佔用,同時修復 fp 量化 matmul 在量化維度非 32 倍數時的結果損壞、GGUF 張量維度校驗與零尺寸軸的 scan/sort。

  2. Ollama blog● 精選AI 評分82

    Ollama 0.35 支援 Jev 決策模型,本地低延遲

    Ollama 0.35 起支援基於 TypeSafe Jev API 的決策模型:通過新的 /v1/systemone 端點,把文字作為 state、配上一組命名問題,本機模型在一次請求裡全部作答,且無額外費用。首批三個模型為 Bespoke Labs 的 9B nimble,以及 Together AI 的實驗性 4B tev1 和 0.8B tev1:0.8b,用 ollama pull 即可下載,可通過 curl 或 TypeSafe 官方 Python SDK 呼叫。

9月25日星期五 · 2 則

  1. Ollama releases● 精選AI 評分86

    Ollama v0.40.0:Apple Silicon 上預設改用 MLX 執行模型

    Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構會自動改用 MLX 執行,無需手動切換。用法與以往一致,例如 ollama pull qwen3.8 後 ollama run qwen3.8。該版本目前為預發布版(v0.40.0-rc0,變更範圍 v0.34.4 到 v0.40.0-rc0),官方稱預發布期間會測試並啟用更多模型,尚未說明具體支援清單與效能差異。

  2. OpenAI Codex changelogAI 評分37

    macOS 26.924 安全更新修復 CVE-2026-100754

    Apple 發布 macOS 安全更新 26.924,修復編號 CVE-2026-100754 的漏洞,對應版本號為 macOS 26.924.20706。公告將這次修復致謝給 Objective-See Foundation 的 Patrick Wardle。除上述內容外,原文未披露漏洞型別、嚴重程度、影響範圍,也未說明是否需要重啟或有哪些臨時緩解措施,發布時間為 2026 年 9 月 25 日。

9月24日星期四 · 1 則

  1. Ollama releases● 精選AI 評分70

    v0.34.4 發布:Qwen 3.8 與 Gemma 4 在 Apple Silicon 上提速

    v0.34.4 發布,更新了 llama.cpp、MLX 和 XGrammar,Qwen 3.8 的提示處理在 Apple Silicon 上更快,Gemma 4 會為每張圖片自動選擇最佳解析度以保留更多高畫質細節。思考模型的結構化輸出改為單次推理完成,速度更快也更可靠;同時修復了本地模型庫很大時偶發的 model not found 報錯,以及 macOS 應用在檢測 ChatGPT 或 Codex 是否執行時無回應的問題。

9月22日星期二 · 1 則

9月19日星期六 · 2 則

9月18日星期五 · 1 則

  1. LM Studio blog● 精選AI 評分82

    Inco AI 開源 Splash 引擎,最佳化 Apple Silicon 本地推理

    Inco AI 發布開源推理引擎 Splash,專為在 Apple Silicon 上本地執行 Qwen3.6-35B-A3B 與 Qwen3.8-27B 最佳化,已整合進 LM Studio Bionic 1.1.5 及以上版本。在 48GB M5 Pro 測試中,Qwen3.8-27B 短提示解碼約 74 tokens/s、32K 上下文 54 tokens/s,約為次快引擎的兩倍;四個併發請求合計吞吐 170 tokens/s,是次快引擎的 3.9 倍。

9月17日星期四 · 1 則

9月3日星期四 · 1 則

8月18日星期二 · 1 則

8月11日星期二 · 1 則

  1. Ollama blog● 精選AI 評分90

    NVIDIA Nemotron 3.5 Lightning 上線 Ollama,可完全本地執行

    NVIDIA 的 30B 總引數(3B 啟用)開源模型 Nemotron 3.5 Lightning 已上線 Ollama,可完全在本地裝置執行。它採用混合 MoE 架構,支援最長 1M token 上下文,並用多 token 預測、DFlash 或 DSpark 投機解碼,吞吐達同類開源模型 4 倍、任務完成時間快 30%,面向呼叫工具、跑測試、檢索程式碼庫等長時 agent 任務。

8月10日星期一 · 1 則

7月21日星期二 · 1 則

7月7日星期二 · 1 則

4月22日星期三 · 1 則

  1. MLX LM releases● 精選AI 評分65

    MLX 發布 v0.31.3,修復快取與工具呼叫多個 bug

    MLX 在 2026-04-22 發布補丁版 v0.31.3,以大量 bug 修復為主,並新增執行緒本地生成流(thread local generation stream),配合 MLX v0.31.2。修復覆蓋 BatchKVCache、BatchRotatingKVCache 與 ArraysCache 的 batch 維度不匹配,以及服務端並行工具呼叫、MiniMax M2 並行工具呼叫和 Mistral 空 tool_call_end 導致的工具呼叫中斷。

4月7日星期二 · 1 則

  1. MLX LM releases● 精選AI 評分75

    mlx_lm 發布 v0.31.2,新增 Gemma 4 支援並重構批處理生成

    MLX 生態的 mlx_lm 發布 v0.31.2(上一版為 v0.31.0),重點是新增 Gemma 4 支援,包括工具呼叫解析器、多 token 的 think 與工具起止標記,並修復其量化逐層投影載入。此次還重構了 BatchGenerator、為非裁剪型快取快取系統提示與使用者訊息,批處理生成器恢復 max-kv-size 引數,伺服器新增 --allowed-origins 選項,並加入 Nemotron super 支援。

3月7日星期六 · 1 則

2月12日星期四 · 1 則

  1. MLX LM releases● 精選AI 評分84

    v0.30.7 發布:修復 Kimi Linear、DeepSeek V3.2,新增 GLM5 與 Qwen3.5

    2026 年 2 月 12 日發布的 v0.30.7 修復了 Kimi Linear 與 DeepSeek V3.2 的 indexer 和權重載入問題,並加快 DSV32 生成速度。這一版新增 GLM5、不含視覺能力的 Qwen3.5 系列與 LongCat MLA 支援,LFM2 模型可用 Pythonic 方式呼叫工具,另加入 Mistral 工具解析器。訓練流程中的驗證集改為可選,還有一項為下一版本提號的版本號變更。