新模型僅用笑話訓練,效果自帶笑點
有開發者發布了一個完全用笑話訓練的新模型,具體名稱、引數規模與訓練資料量均未披露。該帖由使用者 simonbreak 發布,正文只有一句“笑話自己會寫”,沒有給出下載地址、評測結果或使用方式。目前只能確認訓練語料限定為笑話,其他細節和限制未知。
原標題:Have you seen the new model that was trained exclusively on jokes?
閱讀原文
| 評分 | 5 / 5(平均 5,門檻 76) |
|---|---|
| 狀態 | 未入選 |
相關報導
新模型寫作風格趨向高資訊密度與生僻詞彙
有使用者觀察到,近期開源與閉源模型(如 GLM 5.3 Flash)的寫作風格正趨向高資訊密度和更豐富的詞彙,用更少的詞表達更多內容,類似 William Gibson 的壓縮文風。作者認為這可能與 token 效率最佳化有關,但代價是普通讀者難以一眼讀懂,例如模型會使用 Baudrillardian 這類生僻詞。
llama.cpp 上線 Decision 模型與 /v1/systemone 端點
llama.cpp 最新建置已支援 Decision 模型,新增 /v1/systemone 端點,可在本地高效、私密地做 Jev 風格推理。該端點支援多個開源模型,後續還會增加。
Reddit 網友曬開發專案與每月模型開銷
一位 Reddit 使用者在 r/OpenAI 發帖,邀請大家分享正在開發的專案、所用模型和每月花費,並稱小專案也歡迎。發帖人自己正在做一個可與幾位朋友共享的專注房間,用於互相督促學習工作、休息時聊天,並自嘲這大概已經有人做過了。
開發者開源二戰主題小模型 Peacebell,291M 與 148M 兩版
開發者 Wayne Workman 用 11 個月業餘時間從零訓練了專注二戰資訊的小語言模型 Peacebell,已開源權重與訓練材料,含 291M 和 148M 兩個引數版本。148M 版是為參加 HuggingFace 限制 150M 以內模型規模的榜單而做,同時發布了 WWII 主題基準 ww2bench,題目不公開以防進入訓練資料。模型可在 CPU 上執行,作者提供了定製 vLLM fork,並稱其長上下文表現較差,下一版預計 2027 年發布。
LocalLLaMA 討論 jev 分類模型的實際使用體驗
r/LocalLLaMA 使用者分享 jev 系列分類模型(classifier)的真實用例:有人用 jev-reviewer 定位論文證據、避免引用幻覺,有人用 is-malicious 掃描 GitHub 倉庫與 PR 的惡意行為,還有人用 decider 4b 替代 Gemma 雙階段流程,把語音 RPG 延遲從 4-8 秒降到 2-3 秒。