AISpot

搜尋

依意思最接近的 18 筆

NVIDIA blog10/1 09:00AI 評分25

輝達稱 Vera Rubin NVL72 每兆瓦吞吐量超 GB300 30 倍

輝達援引 SemiAnalysis AgentX 資料稱,Vera Rubin NVL72 每兆瓦吞吐量超過 GB300 NVL72 的 30 倍,在 DeepSeek V4 Pro 上每百萬 token 成本最多低 45 倍。輝達以「高產、耐用、通用」概括 AI 工廠回報邏輯:每兆瓦 token 數決定收益,A100 出貨六年後仍在商用,CoreWeave 已將 2020 年首批裝置的預訂延長至 2029 年。

NVIDIA blog● 精選10/2 09:00AI 評分80

NVIDIA DGX Spark 推出 64GB 版,10 月 23 日 4999 美元起

NVIDIA 宣布 DGX Spark 新增 64GB 統一記憶體版本,10 月 23 日由 Acer、ASUS、Dell、Gigabyte、HP、MSI 發售,起售價 4999 美元。該機型保留 GB10 Grace Blackwell 晶片、DGX OS 與完整 AI 軟體棧,支援最高 1000 億引數模型本地執行;兩臺可通過 ConnectX-7 直連組成 128GB 叢集,支援 2000 億引數模型,官方 Qwen 3.8 27B 測試效能提升至 1.7 倍。

Ars Technica AI10/2 10:52AI 評分50

受 AI 推高記憶體成本影響,Nvidia Shield TV Pro 漲價 100 美元

Nvidia 宣布自 2026 年 10 月 2 日起,2019 年發布的 Shield TV Pro 立即漲價 100 美元,從 199.99 美元升至 299.99 美元。Nvidia 發言人向 Ars 確認,漲價源於包括記憶體在內的元器件成本在全行業大幅上漲。該裝置搭載 Tegra X1+ 處理器,支援 AI 畫質提升與幾乎全部媒體格式的硬體解碼,非 Pro 版本已停產。

Hugging Face blog● 精選10/9 11:20AI 評分69

Ai2 用 GPU 時間預算替代優先順序排程

Ai2 把原先基於優先順序的 GPU 排程器換成了由 GPU 時間預算、層級化公平分配和時間切片契約組成的新系統。它管理數千塊 NVIDIA H100、B200、B300,叢集規模從 88 到 1024 塊 GPU,服務約 150 名內部研究者,GPU 需求長期是供給的 2 到 3 倍。舊方案導致 GPU 蹲坑佔位、優先順序通脹(最終 100% 工作負載都標為 HIGH)以及值班工程師大量時間用於協商關閉不可搶佔任務。

Ars Technica AI10/8 07:15AI 評分61

輝達將 Halos 安全架構擴充套件至機器人

輝達在 2026 年 6 月推出 Nvidia Halos for Robotics,把面向自動駕駛的 Halos 安全架構擴充套件到機器人領域。Halos 於 2025 年發布,用硬體和軟體工具幫開發者為自動駕駛汽車等自主系統設定安全護欄,機器人版則覆蓋倉庫自主移動機器人、工廠內人形機器人乃至手術機器人。輝達機器人生態與邊緣計算負責人 Amit Goel 表示,隨著 AI 模型與機器人硬體能力提升,安全被視為下一個瓶頸。

NVIDIA blog10/6 09:00AI 評分48

輝達報告:89% 電信運營商重視開源模型

輝達《State of AI in Telecommunications》報告顯示,89% 受訪者認為開源模型與軟體對公司 AI 戰略重要。運營商看重開源模型的可信任、可控與可定製,用於自主網路、客服等關鍵負載,並把閉源模型留給價值最高的場景;輝達同時發布 300 億引數的 Nemotron 3 Large Telco Model(由 AdaptKey 在開源電信資料集上微調),並提供基於 NeMo 的端到端微調流程。

量子位10/8 06:23AI 評分44

聯想 YOGA Pro 15 開啟盲約,全球首批搭載 NVIDIA RTX Spark N1X

聯想 YOGA Pro 15 RTX Spark 於 10 月 8 日 9:00 開啟全網盲約,為全球首批搭載 NVIDIA RTX Spark N1X 超級晶片的本地智慧體 AIPC。N1X 整合最高 6144 核 Blackwell RTX GPU 與 20 核 Grace CPU,端側算力達 1 Petaflop FP4,整機最高 128GB 統一記憶體、2TB 儲存、80W 滿功耗,可本地執行超千億引數大模型,並出廠預裝 35B 本地模型。

Hacker News front page10/6 12:23AI 評分73

AI 設計的開源加速卡 openTPU 跑通十餘款模型

一個由 AI 設計的開源 AI 加速器 openTPU 已在真實 PCIe 卡上跑通十餘款模型的真實權重,輸出與 bit-exact 模擬器逐位一致。硬體是 Xilinx Kintex-7 xc7k480t 加兩路 DDR3,LFM2.5-230M int8 解碼 59.0 tok/s、4-bit 達 85.8 tok/s;解碼受 DRAM 頻寬限制,實測跑到峰值的 82%-94%。

Hacker News front page10/4 15:42AI 評分72

斯坦福 Ousterhout 提出 Homa 協議替代 TCP

斯坦福教授 John Ousterhout 在 AI Engineer 演講中提出 Homa,一種面向資料中心的全新傳輸協議,認為 TCP 和 RDMA 正成為 AI 叢集的瓶頸。他指出 AI 負載已從大流量梯度傳輸轉向 KV cache 查詢、屏障同步等小訊息協調,這類訊息對延遲敏感,一旦與大數據流混排就會陷入 incast 佇列,拖高尾延遲並讓 GPU 空轉。Homa 基於訊息而非位元組流,採用接收端驅動的擁塞控制,並用 SRPT 優先排程短訊息。

NVIDIA blog10/5 09:00AI 評分47

NVIDIA Inception 初創用 AI 補乳腺癌篩查與治療缺口

輝達 Inception 計劃的多家初創公司正用 AI 補乳腺癌篩查、風險評估與治療規劃的缺口。iSono Health 的 FDA 許可 ATUSA 可穿戴自動 3D 超聲每側乳房約 2 分鐘完成成像,傳統手持超聲最長需 45 分鐘,其敏感度稱高出 28%,已在加州、德州等地診所商用,並啟動 3200 人臨床研究。Whiterabbit.ai 的 FDA 許可 WRDensity 軟體自動評估乳腺密度,已用於數十萬患者;

Hacker News front page10/3 13:23AI 評分68

Vx 發布:把 CPU、GPU、NPU 記憶體寫進型別系統的程式語言

Vx 是一門面向異構計算的系統程式語言,把 CPU、GPU、NPU 與加速器記憶體納入型別系統,主機執行緒解引用裝置指標會直接編譯報錯而非執行時崩潰。它要求跨記憶體空間的資料移動顯式呼叫 transfer(),並用機器檔案描述 H100、H200、B200、A100、MI300X、Apple M4 等真實硬體的記憶體層級與互連,編譯期據此接受或拒絕放置方案。

Ars Technica AI10/2 14:39AI 評分73

美國逮捕涉嫌走私 3 億美元輝達晶片至中國的科技公司 CEO

美國司法部 10 月 2 日宣布逮捕 38 歲的 Earthmade Computer 執行長 Greg Lui,指控其利用虛假檔案將價值超 3 億美元的受出口管制輝達晶片伺服器走私至中國。起訴書稱,Lui 涉嫌與馬來西亞、新加坡等南亞國家的貨運代理公司合謀,非法轉運輝達 A100 和 H100 GPU。美方擔憂這些晶片可用於訓練大語言模型,可能帶來國家安全風險。

r/LocalLLaMA top of the day10/3 14:24AI 評分42

專用推理引擎興起,放棄通用性換極致效能

近期出現一批極窄用途的推理執行時,包括 Strata、ninfer、DwarfStar、Splash、llamAmpere、gufo 等。它們刻意放棄 llama.cpp 與 vLLM 擅長的通用性,只針對少數模型甚至單一硬體家族(如 Strix Halo)做最佳化。作者認為通用執行時負責相容、過擬合執行時負責極致效能將成為常態,並有助於智慧的民主化與去中心化,讓現有硬體在特定配置下榨出最大輸出。

TechCrunch AI● 精選10/7 16:22AI 評分78

微軟發布 Nvidia 晶片 Surface AI PC,2600 美元起

微軟在舊金山 Tech Week 活動上公布新款 Surface Laptop Ultra 的規格與售價:兩款基礎型號分別 2600 美元、3700 美元起,選配更大記憶體與儲存後最高 5900 美元,頂配已售罄;同時發布 6000 美元起的 Surface RTX Spark Dev Box 工作站,預裝 VS Code、GitHub Copilot CLI、WSL 與 PowerShell 7。

llama.cpp releases10/9 05:29AI 評分50

llama.cpp b11518 為 Metal 新增 128/96 Flash Attention 核心

llama.cpp 發布 b11518,Metal 後端加入 128 與 96 兩檔 Flash Attention 核心,並接受所有已編譯的維度組合(#30209)。該版本同時提供 macOS/iOS、Linux、Android、Windows 與 openEuler 的預編譯產物,覆蓋 CPU、Vulkan、CUDA 12/13、ROCm 10.0、SYCL、OpenVINO 及 Snapdragon 的 Adreno GPU 與 Hexagon NPU;

Ars Technica AI● 精選10/7 20:00AI 評分80

微軟 Surface Laptop Ultra 發布:首發 RTX Spark,2599 美元起

微軟在兩年來的首場線下活動中發布 Surface Laptop Ultra,這是首款搭載 Nvidia RTX Spark SoC 的裝置,起售價 2599 美元,10 月 16 日開始發貨,現已開啟預售。它可選 5120 核或 6144 核 Blackwell GPU,統一記憶體最高 128GB LPDDR5x,依靠統一記憶體分配而非傳統視訊記憶體上限,兼顧本地 AI 開發部署與 3A 遊戲執行。