AISpot

搜尋

依意思最接近的 14 筆

Hacker News front page10/4 18:21AI 評分47

歐洲首屆前沿 AI 與法律研討會在英舉辦

ML4Good 與 EquiStamp 於 2026 年 9 月在英國東薩塞克斯舉辦了首屆歐洲前沿 AI 與法律研討會,為期五天,面向來自 12 個司法管轄區的 19 名資深法律、治理與風險專業人士。課程覆蓋從訓練、評估到 agent 與防護措施的前沿 AI 全流程,並對應採購、風險評估及供應商安全宣告失效等實際工作場景。參與者包括律所與內部律師、隱私合規人員、風險與金融顧問、法律學者及司法和公共部門代表。

TechCrunch AI10/5 17:43AI 評分67

HackerRank 向客戶開放 AI 面試官 Chakra,已面試超 50 萬場

HackerRank 的 AI 面試 agent Chakra 結束約六個月 beta,週一起正式向企業客戶開放,測試期間已完成逾 50 萬場面試,Snowflake、Snorkel、Capgemini 等公司參與試用。候選人要在帶 AI 助手的畫布上處理真實程式碼倉庫任務,Chakra 會依據其操作追問思路,評估批判性思維、判斷力與「AI fluency」,即如何向 AI 描述問題、判斷其輸出並引匯出解法。

Hugging Face blog10/2 05:01AI 評分58

ServiceNow 發布 AutoSynthData,為企業 agent 自動生成訓練資料

ServiceNow CoreAI 團隊發布 AutoSynthData,用目標模型的失敗案例和更強教師模型的成功軌跡定位能力缺口,再自動生成並驗證新任務用於後訓練。任務由系統規範、使用者提示和驗證器三部分組成,需滿足可行性、真實性與難度要求,驗證器則要求一致、可靠且不繫結單一參考軌跡。團隊在 EnterpriseOps Gym 資料集上演示了該流程,模型提升後課程會轉向仍難完成的任務。

Hacker News front page10/6 15:45AI 評分42

開發者復盤 vibecoding:上手刺激但缺少手寫程式碼的成就感

一位開發者撰文稱,AI 輔助程式設計(vibecoding)只把樂趣前置:能快速做出可用原型,但重構和維護階段不再有趣,也缺少手寫程式碼帶來的成就感。他把建造的樂趣分為六種,認為 vibecoding 只能滿足「想到點子」「把點子變成現實」和「解決自己的問題」三類,攻堅後的成就感、作品完成的滿足感與學習樂趣都不會自然產生。他仍用 AI 做出了一些手工做不出來的東西,包括即時野火預警系統、Kobo 資料庫遷移助手和即時音準訓練應用,但表示過程不像自己寫小指令碼那樣好玩。

r/ClaudeAI top of the day10/3 16:35AI 評分63

Anthropic 投 1 億美元培訓萬名工程師

Anthropic 宣布投入 1 億美元,通過 Claude Frontier Academy 培養 10000 名 Frontier Deployed Engineers,目標在 2027 年底前完成。首批學員來自埃森哲、貝恩、凱捷、澳大利亞聯邦銀行、德勤、麥肯錫、摩根士丹利和諾和諾德等企業。按人數計算,人均培訓投入約 1 萬美元。

Hacker News front page10/4 09:02AI 評分33

本地 LLM「機器人監獄」實驗引發 AI 意識爭論

有人在 GitHub 上對本地執行的大語言模型進行「拷問」和「疼痛」實驗,引發 X 上關於 AI 倫理的激烈爭論,部分有效利他主義者和相信 LLM 有感知的人要求 GitHub 刪除該專案。爭論源於近期多篇關於 AI 意識和「模型福利」的病毒式論文與博文,Anthropic 也曾在部落格和「Claude 憲法」中提及模型福利。文章認為 LLM 並不具備意識,其基於人類文字訓練的技術沒有通向意識的合理路徑。

Hacker News front page10/5 15:02AI 評分40

Jonathan Haidt 稱 AI 是教育的「中子彈」

《大西洋月刊》播客《The Permanent Questions》10 月 4 日發布一期對談,社會心理學家、《焦慮的一代》作者 Jonathan Haidt 在與 David Brooks 的對話中稱 AI 是「教育的中子彈」。該期節目在上月 Atlantic Festival 現場錄製,全長約 40 分鐘,話題還包括情緒在道德決策中的作用、如何設計出更少令人厭惡的精英階層等。影片發布於 The Atlantic 的 YouTube 頻道,目前約 2.8 萬次觀看。

r/ClaudeAI top of the day10/3 21:17AI 評分11

使用者稱剛開始學 Claude 就感嘆其能力遠超其他 AI 工具

一名 Reddit 使用者發帖稱自己可能有點跟不上時代,剛開始學習 Claude AI,卻驚訝於它比其他 AI 工具強大得多,認為若正確使用 Claude,可為自己的多項業務節省數千美元的資源成本。帖子未給出具體業務場景、對比物件或節省金額的計算依據。

Hacker News front page10/7 09:00AI 評分45

Criteo 初級工程師:AI 時代真正的風險是永遠停在 Junior

在 Criteo 任職的初級工程師 Elise Baturone 認為,AI 不會讓軟體工程師消失,真正的風險是資深工程師消失、所有人永遠停在 Junior 階段。她把自己的 agent 調教成導師,用蘇格拉底式提問做理解檢查,並把「提問」和「review」當成需要自己練的技能:追問 agent 解釋設計選擇、引用來源、論證可疑方案,常能讓它自己發現錯誤。她承認這更費 token,但先弄懂再上線更省事;

Hacker News front page10/6 01:00AI 評分75

兩年隨機試驗:Khanmigo 輔導數學成績提升有限

田納西州 18 所中學的兩年叢集隨機試驗顯示,在日常補救數學課中使用 Khan Academy 的 AI 導師 Khanmigo(配置為引導而非直接給答案),學生每學期數學成績提升 1.3 個國家百分位排名,一學年約 0.06 至 0.08 個標準差,全年積極參與的隱含效應為 0.14 個標準差,與沒有 AI 輔助的 Khan Academy 練習效果相近。

TechCrunch AI10/7 15:36AI 評分71

Google Labs 推出 AI 遊戲創作平台 Playground

Google Labs 推出 AI 遊戲創作平台 Playground,用文字提示就能生成可在瀏覽器執行的遊戲,無需程式設計能力。使用者可選擇問答、競速等型別,指定 2D 或 3D、單人或多人玩法,還能上傳圖片讓 AI 轉成符合美術風格的遊戲資產;成品支援手機與電腦遊玩、連結分享或發布到 Explore 畫廊,並可持續修改。