AISpot

搜尋

依意思最接近的 30 筆

Simon WillisonAI 評分43

tiktoken 命令列工具 ttok 發布 0.4,新增 --list-models

基於 OpenAI 開源 tiktoken 庫的命令列 token 計數工具 ttok 發布 0.4 版,新增 --list-models 命令可列出可用模型,同時修復了一處 Click 警告並更新了 CI。該專案已約兩年沒有更新,這次屬於維護性版本。ttok 可直接通過 uvx 執行,例如把檔案內容用管道傳入 cat file.txt | uvx ttok 就能統計其中的 token 數。

Hacker News front page● 精選AI 評分87

OpenAI 公布歐盟文字溯源方案,API 可選用文字水印

OpenAI 公布應對歐盟 AI 法案的文字溯源方案:全球 API 客戶即日起可為部分模型選擇開啟文字水印(預設關閉),未來幾週將在歐盟的 ChatGPT 與 Codex 文字輸出中加入不可見水印,檢測器僅向獲批研究者與專家組織開放申請。其自研 textGrain 通過統計訊號標記用詞,在 1% 誤報率下對 200 token 段落檢出約 80%、400 token 約 95%,數學等用詞受限內容明顯更低;

NVIDIA blog● 精選AI 評分85

OpenAI 上線 GPT-6 Astra Ultrafast,基於 NVIDIA Blackwell

GPT-6 Astra Ultrafast 已在 OpenAI API 上線,並向符合條件的 ChatGPT Work 與 Codex 使用者開放,執行在 NVIDIA Blackwell GPU 上。官方稱其 token 生成速度最高可達 Astra Standard 模式的 8 倍,可縮短 coding agent 的編輯—測試—除錯迴圈,並減少工具呼叫之間的等待。開發者可通過 API 使用,訪問方式、價格與實現細節見 Ultrafast 指南。

機器之心● 精選AI 評分68

Jev 走紅,NeurIPS 2025 論文 ConfTuner 早已探索相似思路

TypeSafe AI 的 Jev 模型近期走紅,其介面可直接返回預設選項、分數或事件機率,供程式碼呼叫,但未開源、架構未公開。NeurIPS 2025 入選論文 ConfTuner 提出 Tokenized Brier Score,僅用對錯標籤即可訓練置信度機率分佈,在 LLaMA、Qwen、Ministral 上把平均 ECE 從 0.2768、0.3781、0.4393 降至 0.1082、0.2872、0.1884,4 張 A40 上約 4 分鐘完成微調。

Hacker News front pageAI 評分75

研究:LLM 用 1866 年電報體壓縮記錄可省近半 token

一份 50 篇材料、約 1300 題的新基準(Telegraph Test,程式碼與資料已開源)顯示,只需一句小寫指令讓模型用 1866 年跨大西洋電纜時代的電報體(cablese)撰寫壓縮記錄,輸出 token 可省 40%–49%,而下游模型讀取這些記錄的準確率不低於明文(恢復比 0.99–1.10)。GLM-5.3-Flash 自身省 48.4%,qwen3.8-27b 省 48.9%,gemma-4-31b 省 40.4%;

量子位AI 評分46

AI 程式設計模型集體滿口黑話:思維鏈壓縮省 70% Token

量子位發文吐槽,Fable、Sol 等與 Coding 沾邊的模型普遍輸出「15/15 全綠」「單腿啞火」這類黑話。文中分析,除 Coding 過擬合外,更主要的原因是廠商為省 Token 把思維鏈壓縮成「穴居人語」,OpenAI 最早這麼做,同樣一句話的 Token 消耗比白話文少 70%;Claude 自 Opus 4.6 起也開始如此。作者稱最新 Opus 5.5 語言能力回升明顯,而 Gemini 因輸出風格正常、排版層級清晰,被社群視為少數還能正常溝通的 AI。

X @GoogleDeepMind● 精選AI 評分85

SynthID Detector 向所有人開放,可檢測多家 AI 生成內容

Google DeepMind 宣布 SynthID Detector 現已向所有人開放,可用來判斷網上內容是否由 AI 生成。該工具除 Google AI 外,還支援檢測 OpenAI、NVIDIA、Kakao 等行業夥伴工具生成的內容,Apple 即將加入。使用者可通過 synthid.com 試用。

Hacker News front pageAI 評分46

Anthropic 文章設想 AI 每秒輸出百萬 token

Anthropic 發布一篇思想實驗文章,探討「每秒 100 萬 token」的四種含義:上下文容量、輸入處理速度、聚合吞吐量和單智慧體輸出速度,並強調這不是對任何現有模型的實測。文中以 Claude Opus 5.5 為例,其上下文視窗為 100 萬 token,但單次請求輸出上限遠小於此。文章用互動計算器演示:若單智慧體達到每秒 100 萬 token,1000 個故事結局約 1 秒寫完,但加入 60 秒固定檢查後,端到端加速從 10000 倍降至 132.57 倍。

Hacker News front pageAI 評分62

Treg 上線:一個 token 呼叫數千個 agent 工具

Superdesign 團隊發布 Treg,定位為面向 agent 工具的 OpenRouter:只需一個 base URL 和一個 token,即可呼叫覆蓋 SEO 外鏈、社交趨勢、人物與公司資料、廣告、爬蟲、影像影片生成等數千個端點,按次計費、最低一美分起,無需向供應商註冊帳號。目錄內工具由 Treg 自帶 key 或公開路由代付,團隊自有 key 的呼叫不計費,新驗證團隊可獲 1 美元免費額度。

X @claudeaiAI 評分43

Claude 稱 Haiku 5.5 在 10 萬 token 以下任務價效比突出

Claude 官方帳號稱,Haiku 5.5 在 10 萬 token 以下的任務上價效比尤其突出。官方給出的依據是,這類任務約佔此前 Haiku 模型所收到請求的 90%,意味著絕大多數實際呼叫都落在這一區間內。該帖由 @claudeai 發布,未披露 Haiku 5.5 的具體價格、上下文長度或基準測試成績,也未與其他模型做對比。

Hugging Face blog● 精選AI 評分70

Ai2 開源 AstaBrief 8B 科學報告生成模型

Ai2 開源了 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,已作為 Asta 的 Fast 模式上線。官方稱 Fast 模式平均 51.1 秒生成一份報告,比 Claude 驅動的 Thinking 模式 178.5 秒快約 3.5 倍。模型權重、訓練資料與範例工作流一併開放,機構可在自有基礎設施上本地生成報告。

llama.cpp releasesAI 評分37

llama.cpp b11471 為詞表加入 Plamo FIM tokens

llama.cpp 發布 b11471 建置,主要變更是向詞表加入 Plamo 的 FIM(fill-in-the-middle)tokens,服務程式碼補全場景。該版本發布包覆蓋 macOS/iOS、Linux、Android、Windows 與 openEuler,後端包含 CPU、Vulkan、CUDA 12.8/13.4、ROCm 10.0、OpenVINO、SYCL,以及 Snapdragon 的 Adreno GPU 與 Hexagon NPU。

機器之心● 精選AI 評分88

OpenAI 啟用文字水印,歐盟 ChatGPT 與 Codex 輸出將被標記

OpenAI 宣布正式啟用文字水印:即日起全球 API 客戶可為部分模型自行開啟,預設關閉;未來幾週歐盟地區符合條件的 ChatGPT 與 Codex 文字輸出將被加上肉眼不可見的水印,覆蓋所有付費檔位,檢測器僅向稽核過的研究者和專業機構開放。配套技術報告 textGrain 由今年考普斯會長獎得主蘇煒傑擔任通訊作者,用可調的「熵預算」控制水印強度。

Ollama releasesAI 評分45

MLX v0.40.0-rc1 對齊發布方 tokenizer 語義

MLX 發布 v0.40.0-rc1,核心改動是讓本地 tokenizer 與模型發布方的語義保持一致,涵蓋預分詞階段順序、切分行為、Unicode 邊界、added token 歸一化和 BPE 合併排序,並統一處理空 added token 與空 Metaspace 輸入。同時新增 Go/Python 共享參考用例,直接拉取缺失模型並在出錯時失敗,另加配置優先順序、位元組回退與並行編碼的迴歸測試。

X @OpenAI● 精選AI 評分84

OpenAI 將在歐盟為 ChatGPT 與 Codex 文字加水印

為滿足歐盟 AI 法案的監管要求,OpenAI 將內容溯源範圍從影像、音訊擴充套件到文字,未來幾週內在歐盟開始對 ChatGPT 和 Codex 的合規文字加水印。其 API 客戶即日起可在全球範圍內為部分模型開啟文字水印。OpenAI 同時承認,當前文字水印技術存在明顯侷限。

r/LocalLLaMA top of the dayAI 評分65

LiquidAI 發布 LFM2.5-Encoder 250M/350M 編碼器

LiquidAI 發布 LFM2.5-Encoder 系列,含 250M 與 350M 兩個版本,基於 LFM2 架構的雙向掩碼語言模型,支援 15 種語言、8k 上下文,可微呼叫於分類、檢索、重排與語義相似度等任務。官方稱其吞吐量持平或超過 ModernBERT,CPU 長上下文有優勢,並可在瀏覽器 WebGPU 上執行;GGUF 權重已上傳 Hugging Face,llama.cpp 已提交對應支援 PR。

量子位● 精選AI 評分89

OpenAI 瘋狂 28 天首日:GPT-6 提速 50%,網友實測未達標

OpenAI Codex 負責人 Tibo 的 28 天計劃首日,官方宣布 GPT-6 Astra 與 GPT-6.1 Sol 預設推理速度提升約 50%、達 50TPS,覆蓋官方訂閱及 OpenCode、Amp 等第三方接入,但網友實測僅約 35TPS。同期 OpenAI 在 ChatGPT 影像生成中測試視覺廣告,並將在幾週內為歐盟地區 ChatGPT 和 Codex 生成的文字加隱形水印。

The Verge AI● 精選AI 評分80

OpenAI 在 ChatGPT 和 Codex 推出文字水印,首批僅限歐盟

OpenAI 開始在 ChatGPT 和 Codex 的文字輸出中加入不可見、機器可讀的水印,初期只面向歐盟使用者。OpenAI 稱自研的 textGrain 水印與 Google DeepMind 的 SynthID for text 等方法相比持平或更優,後者也是 Anthropic 8 月宣布的水印基礎;兩家公司都是為了滿足歐盟 AI Act 的要求。OpenAI 還給出 AI 基準分數,顯示加水印與未加水印文字表現相近,但表示 textGrain 並不保證……

Ars Technica AI● 精選AI 評分82

OpenAI 將在歐盟預設給 ChatGPT 輸出加水印

OpenAI 宣布將在歐盟自動為 ChatGPT 生成的文字加水印,其他地區也提供該功能,但預設關閉。這是為遵守 8 月生效的歐盟 AI Act,該法要求 AI 生成內容可被其他工具檢測。OpenAI 的水印方法名為 textGrain,屬專有技術並已發布技術論文:它在用詞中埋入人類難以察覺、也不影響輸出品質的模式,持有金鑰者可用專用檢測器識別。檢測器初期只向有限的研究者與機構開放,其他方需經申請審批逐步加入。

Hacker News front pageAI 評分73

AI 設計的開源加速卡 openTPU 跑通十餘款模型

一個由 AI 設計的開源 AI 加速器 openTPU 已在真實 PCIe 卡上跑通十餘款模型的真實權重,輸出與 bit-exact 模擬器逐位一致。硬體是 Xilinx Kintex-7 xc7k480t 加兩路 DDR3,LFM2.5-230M int8 解碼 59.0 tok/s、4-bit 達 85.8 tok/s;解碼受 DRAM 頻寬限制,實測跑到峰值的 82%-94%。

OpenCode releasesAI 評分43

OpenCode v1.18.35 發布:修復 xAI 工具結果圖片傳遞

OpenCode 發布 v1.18.35,核心改進是新增 canonical redirects,並提供 JSON 與 Markdown 兩種格式的 agent 可讀統計資料。本次修復讓 xAI 的工具呼叫結果可以攜帶受支援的圖片,不支援的圖片格式會被跳過,做法是把 @ai-sdk/xai 升級到 3.0.139。文件方面,Zen 文件新增 Fledge Alpha Free,生態外掛列表加入 opencode-supabase,該版本同時致謝 3 位社群貢獻者。

Claude Platform release notes● 精選AI 評分88

Claude Haiku 5.5 發布:1M 上下文,自適應思考預設開啟

Anthropic 推出 Claude Haiku 5.5(claude-haiku-5-5),面向高併發與低延遲場景。該模型提供 1M token 上下文視窗、128k 最大輸出 token,並支援通過 effort 引數調節的自適應思考。已在 Claude API、Amazon Bedrock、AWS 上的 Claude Platform、Google Cloud 和 Microsoft Foundry 上線。

TechCrunch AIAI 評分72

TikTok 上線 AI 購物助手與一鍵結賬,資訊流內可直接下單

TikTok 宣布推出 AI 購物助手和 App 內一鍵結賬,使用者可直接從 For You 資訊流向品牌下單。購物助手是對話式 AI,能理解上下文並記住使用者偏好,提供商品詳情、物流、尺碼、庫存等即時導購併協助完成購買。新功能與 Salesforce、Shopify、Shoplazza、Stripe 等商務及支付平台合作搭建,把購物能力從 TikTok Shop 擴充套件到整個 App。

量子位AI 評分46

聯想天禧 TianxiCode 登頂 SWE-bench-Live,問題解決率 71%

聯想天禧 AI 自研程式碼智慧體框架 TianxiCode 配合 DeepSeek-v4.1-Flash,在 SWE-bench-Live(Lite 分榜)以 71% 的問題解決率位列全球第一,並通過官方 Verified 核驗。該評測基於真實 GitHub 專案問題與可復現執行環境,官方會審查全鏈路智慧體執行軌跡並排查答案、測試用例洩露。

X @OpenAIDevsAI 評分27

@OpenAIDevs: Your dot learns how you work, keeps context across apps, coordinates Codex tasks, and flags what ne…

OpenAI 開發者帳號發布預告,介紹一款名為 dot 的產品:它會學習使用者的工作方式,跨應用保留上下文,協調 Codex 任務,並標記需要使用者關注的事項。該訊息未披露發布時間、價格、支援平台或具體功能細節。

TechCrunch AIAI 評分68

非文字模型 Jev 開發商融資 8.7 億美元,估值 75 億

TypeSafe AI 以 75 億美元估值完成 8.7 億美元融資,由 Andreessen Horowitz 領投,紅杉與現有投資方 DCVC 參投。其模型 Jev 於 9 月 15 日發布,基於 transformer 架構但不是大語言模型,不輸出文字而是生成機率,公司稱之為「校準決策」,定位是自動化任務而非寫文字或程式碼。公司稱 Jev 速度明顯更快、消耗 token 遠少於 LLM,並稱已有三分之一財富 500 強企業在使用;

量子位● 精選AI 評分79

OpenAI Codex 負責人承諾 28 天內每天改進或重置額度

OpenAI Codex 負責人 Tibo 承諾,接下來 28 天每天二選一:交付一項對大多數 Codex/Work 使用者明顯有用的改進,或進行一次完整的額度重置。所謂改進既可能是新發布,也可能只是修 Bug;此前他向社群徵集 Codex 還缺什麼,並把工作鎖定在簡化產品、提高效率以支援更多使用、突破性功能和新模型四個方向。