AISpot

搜尋

依意思最接近的 8 筆

r/OpenAI top of the day● 精選10/3 16:36AI 評分80

OpenAI 發布 GPT-6 系列模型指南

OpenAI 發布了 GPT-6 系列的模型指南,內容涵蓋模型選擇、推理強度(reasoning effort)與工具使用。該指南面向使用 GPT-6 系列的開發者,幫助其在具體場景中決定選哪個模型、投入多少推理算力以及如何呼叫工具。原文未披露具體模型型號、引數或發布時間等細節。

Hugging Face blog● 精選10/2 16:19AI 評分65

Ai2 開源 AstaBrief 8B 科學報告生成模型

Ai2 開源了 8B 的科學報告生成模型 AstaBrief,可把研究問題和檢索到的文獻片段直接寫成帶引用的報告。它已在 Asta 的 Generate a report 功能中以 Fast mode 上線,與 Claude 驅動的 Thinking mode 並列:Fast mode 平均 51.1 秒生成一份報告,Thinking mode 為 178.5 秒,快約 3.5 倍。模型基於 Qwen3-8B,用 SFT 加 DPO 訓練,一次成稿,跳過了片段摘要與聚類環節。

Hacker News front page10/2 22:25AI 評分62

Ai2 開源 AstaBrief 8B 科學報告模型與訓練資料

Ai2 開源 AstaBrief 8B:一個把研究問題與檢索到的文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 用 SFT 與 DPO 訓練,權重、訓練資料和一份可從自己 PDF 生成報告的範例工作流一併放出。它已作為 Asta 的 Generate a report 功能中的 Fast mode 上線,與 Claude 驅動的 Thinking mode 並存;

X @karpathy10/2 01:37AI 評分50

Karpathy 建議用圖表、網頁和影片理解 LLM 輸出

Karpathy 認為,隨著 LLM 能力提升,人的工作會更多轉向監督與理解模型輸出,而 LLM 本身也能幫忙。他推薦幾個技巧:讓模型用 ASD-STE100 受控語言寫作,或要求輸出 HTML 網頁、圖表,甚至定製講解影片,例如用 ElevenLabs API key 生成 3b1b 風格影片。這些大型、一次性軟體產物以前不值得做,現在可以按需生成。

Hacker News front page10/3 20:12AI 評分20

Our AI Midwife

Astral Codex Ten 發布文章《Our AI Midwife》,講述用 AI 充當接生助手的經歷,原文連結已公開。該文在 Hacker News 上獲得 32 分、5 條評論,討論熱度不高。文章具體使用的模型、工具與效果原文未在給定資訊中說明。

r/LocalLLaMA top of the day10/3 05:10AI 評分33

新模型寫作風格趨向高資訊密度與生僻詞彙

有使用者觀察到,近期開源與閉源模型(如 GLM 5.3 Flash)的寫作風格正趨向高資訊密度和更豐富的詞彙,用更少的詞表達更多內容,類似 William Gibson 的壓縮文風。作者認為這可能與 token 效率最佳化有關,但代價是普通讀者難以一眼讀懂,例如模型會使用 Baudrillardian 這類生僻詞。