SocioVerse2 發布:開源社會模擬框架支援干預與反事實分支
上海創智學院、復旦大學、倫敦國王學院與牛津大學等團隊發布開源社會模擬框架 SocioVerse2,把 LLM 社會模擬從截面問卷擴充套件為可干預的縱向過程。研究者在任意時間步插入干預,系統回放已記錄的動作生成反事實分支,分叉前人群、行為模型與隨機種子一致;研究過程則以可編輯的版本樹組織,每個版本儲存完整快照。
把反事實分支、版本回溯與時點安全的資料服務做成開源基礎設施,使干預與對照的差異可歸因,對做政策、輿論與宏觀預測的社會科學研究者和智慧體開發者最有參考價值。
原標題:SocioVerse2:长程推演的社会模拟实验基地,让研究者和智能体携手进化
閱讀原文
| 評分 | 66 / 70(平均 68,門檻 65) |
|---|---|
| 狀態 | 精選 |
相關報導
llama.cpp 新增 Decision 模型支援
llama.cpp 最新建置已加入 Decision 模型支援,新增 /v1/systemone 端點,可在本地進行 Jev 風格推理,兼顧效率與隱私。目前支援多個開源模型,官方表示後續還會增加更多模型。
Anyworld:本地 LLM 當 DM 的自託管多人文字 RPG
Anyworld 是一款瀏覽器端多人文字冒險遊戲,由房主用 llama.cpp 本地跑模型充當 DM,也支援 OpenAI 等雲 API,玩家只需開啟連結即可加入。行動結果由 Python 真實擲骰決定,模型只負責敘述;支援自訂劇本、隱藏劇情觸發、場外聊天和斷線重連。開發時用 Gemma 4-26B-A4B Q4、128k 上下文,在 RTX 5070 Ti 16GB 上每輪結算約 5 秒。
Safeworld 獲 1200 萬美元種子輪,為 AI 機器人做安全模擬
Safeworld 結束隱身狀態,宣布由 Shine Capital 與 a16z Speedrun 領投、Box Group、卡內基梅隆大學捐贈基金等參投的超 1200 萬美元種子輪。該公司由 CMU Safe AI 實驗室主任 Ding Zhao 與 Kyle Wong、Simo Rachidi 創立,做法是在 Genesis、MuJoCo 等模擬環境中接入待評估機器人的真實控制軟體,跑數千個真人模型與機器人相遇的場景,檢驗工廠盲區碰撞、跌倒、搬運等邊緣情況。
Latent Space 專訪 MIT Alex Zhang:談 RLM 與 agent 叢集
Latent Space 播客本期嘉賓為 MIT 的 Alex Zhang,他是 Recursive Language Models(RLM)的作者,也是 GPU Mode 社群成員。
ServiceNow 發布 AutoSynthData,為企業 agent 自動生成訓練資料
ServiceNow CoreAI 團隊發布 AutoSynthData,用目標模型的失敗案例和更強教師模型的成功軌跡定位能力缺口,再自動生成並驗證新任務用於後訓練。任務由系統規範、使用者提示和驗證器三部分組成,需滿足可行性、真實性與難度要求,驗證器則要求一致、可靠且不繫結單一參考軌跡。團隊在 EnterpriseOps Gym 資料集上演示了該流程,模型提升後課程會轉向仍難完成的任務。