Rampart 開源:14.7MB 瀏覽器端 PII 脫敏,延遲 3.9ms
NDS 開源 Rampart:一個完全在瀏覽器內執行的個人資訊脫敏系統,模型含分詞器僅 14.7MB,WebGPU 下 p50 延遲 3.9ms。它由正則校驗層和 MiniLM 小模型組成,前者處理社保號、信用卡、帳號等結構化資訊,後者識別人名與街道地址。在覆蓋七種語言的 3 萬行 OpenPII 測試集上,私有詞召回率 98.42%,高於約 2.8GB 的 OpenAI Privacy Filter(97.4%)。
把 PII 脫敏做成 14.7MB、瀏覽器內 3.9ms 延遲的開源庫,98.42% 召回率高於體量約 2.8GB 的 OpenAI Privacy Filter,對開發聊天類 AI 產品、關注裝置端隱私的人有用。
原標題:Rampart: Browser native on-device PII radaction
閱讀原文
| 評分 | 78 / 75(平均 76,門檻 76) |
|---|---|
| 狀態 | 精選 |
相關報導
OpenAI 上線 Decisions API 公測,僅支援 gpt-6-luna
OpenAI 的 Decisions API 進入公測,官方稱其評估文字、影像或兩者並返回結構化答案的速度約為 Responses API 的 10 倍,預計數週內 GA。該 API 使用獨立的 POST /v1/decisions 端點,目前僅支援 gpt-6-luna,問題分三類:predicate 返回條件成立機率(0 到 1)、choice 從給定選項中選一個、score 按有序等級給出機率加權平均分。
OpenAI 公布歐盟文字溯源方案,API 可選用文字水印
OpenAI 公布應對歐盟 AI 法案的文字溯源方案:全球 API 客戶即日起可為部分模型選擇開啟文字水印(預設關閉),未來幾週將在歐盟的 ChatGPT 與 Codex 文字輸出中加入不可見水印,檢測器僅向獲批研究者與專家組織開放申請。其自研 textGrain 通過統計訊號標記用詞,在 1% 誤報率下對 200 token 段落檢出約 80%、400 token 約 95%,數學等用詞受限內容明顯更低;
Cloudflare 開源決策模型 Clef,並推出 RL 微調平台
Cloudflare 發布兩個自研決策模型 Clef 與 Clef-flash,託管於 Workers AI,並以 Apache 2.0 許可在 Hugging Face 開源,可本地執行。Clef 在 Jev Decision Index 上排名第一,具備視覺編碼器與 64k 上下文視窗,中位延遲 209.3ms,快於 Jev 的 524.1ms。同時推出強化學習微調產品,供使用者按自身場景微調 Clef。
DensePack 把文字打包成圖片,為 Claude Code 省約一半 token
開發者發布 DensePack,將 Read 讀取的文字檔案、Bash 輸出、Word 文件和子代理報告打包成圖片供 agent 讀取,聲稱按約 50% 的價格完成同樣的文字 token 化,且後續快取讀取也按這一折扣計費。作者稱已跑過逾 1 萬次基準測試,圖片用獨特配色加兩行圖例,可從圖片逐位元組還原始碼檔案,並保留文字副本作為校驗回退。專案發布兩週獲 8 個 star,已通過 Anthropic 外掛提交的初期階段,最新版本 1.3.3,1.4 計劃支援與其他外掛共用。
微軟發布 Decision-1 決策模型,比 GPT-6 Sol 快 35 倍
微軟推出決策評分模型 Microsoft-Decision-1,已在 Microsoft Foundry 上線,並將登陸 OpenRouter。該模型基於 Qwen3.5-9B 後訓練,用於路由、分類、優先順序排序、驗證與工作流控制,支援是/否、多選、評分及對 AI 回答和 agent 動作的 rubric 打分。官方稱其在 36 項基準、近 15 萬道題中準確率最高,P50 延遲比 GPT-6 Sol 快約 35 倍、比第二名 Quyet-1.0-Large 快 4.5 倍;