Karpathy 發布可玩瀏覽器版指環王電影
Karpathy 把指環王電影的原始碼上傳到 karpathy.ai/lotr-movie,可在瀏覽器直接遊玩、fork。這條推文同時轉發了 Simon Willison 關於「鵜鶘騎腳踏車」測試的後續文章,並調侃 GTA Hobbiton 會比 GTA VI 先發布。
找到 5 筆
Karpathy 把指環王電影的原始碼上傳到 karpathy.ai/lotr-movie,可在瀏覽器直接遊玩、fork。這條推文同時轉發了 Simon Willison 關於「鵜鶘騎腳踏車」測試的後續文章,並調侃 GTA Hobbiton 會比 GTA VI 先發布。
Karpathy 提出一個簡單評測:只給 LLM 一個經緯度文字座標,問它“Land or Water?”,重複 16200 次後把結果畫成影像。他表示模型能答對,原因是訓練時壓縮了網際網路資料。該評測無需額外工具,可直接用 API 批次跑。
Karpathy 認為,隨著 LLM 能力提升,人的工作會更多轉向監督與理解模型輸出,而 LLM 本身也能幫忙。他推薦幾個技巧:讓模型用 ASD-STE100 受控語言寫作,或要求輸出 HTML 網頁、圖表,甚至定製講解影片,例如用 ElevenLabs API key 生成 3b1b 風格影片。這些大型、一次性軟體產物以前不值得做,現在可以按需生成。
Karpathy 給 Opus 5 輸入《魔戒》第一段、100 萬 token 預算(約 10 美元),讓它用 three.js 渲染這個故事。Opus 5 執行約 2 小時,寫出 5500 行程式碼,程式化生成了粗糙但可玩的 3D 場景。他指出這類任務沒人願意手工做,但 LLM 有無限耐心,成本近乎免費;同時也暴露 LLM 無法原生高效感知影片或玩遊戲,只能緩慢截圖自查,導致不少瑕疵。
Karpathy 說他常用一種「長時間語音漫談」的方式與 LLM 協作:當懶得打字、又需要給模型更多上下文時,就切到 /voice 連續說上約 10 分鐘,內容雜亂、意識流、允許錯別字。他有時會先宣告「已切換到語音識別,抱歉有錯字」,有時把它變成幾輪小訪談。他發現 LLM 很擅長重建這種長而不連貫的漫談,複述出來的思路往往比原話更清晰,從而減少後續糾正。