阿里 Qwen 發布新基準測試套件
阿里 Qwen 團隊在 2026 年 9 月 23 日發布了一套基準測試套件,但公開資訊僅有一句“Benchmark suite:”,沒有披露測試專案、覆蓋模型、評分方式或開源地址等細節。目前無法判斷它針對哪類模型、是否包含 coding agent 或本地推理場景。
原標題:@Alibaba_Qwen: Benchmark suite:
閱讀原文
| 評分 | 15 / 15(平均 15,門檻 60) |
|---|---|
| 狀態 | 未入選(舊聞,已歸檔) |
阿里 Qwen 團隊在 2026 年 9 月 23 日發布了一套基準測試套件,但公開資訊僅有一句“Benchmark suite:”,沒有披露測試專案、覆蓋模型、評分方式或開源地址等細節。目前無法判斷它針對哪類模型、是否包含 coding agent 或本地推理場景。
原標題:@Alibaba_Qwen: Benchmark suite:
閱讀原文
| 評分 | 15 / 15(平均 15,門檻 60) |
|---|---|
| 狀態 | 未入選(舊聞,已歸檔) |