三個 Qwen3.8 權重在 RTX PRO 6000 上本地實測
2026/10/03 — 10/03 06:11·1 個來源·1 篇報道
事件概覽
2026 年 10 月 3 日,Reddit 的 LocalLLaMA 版塊出現一篇本地實測帖,作者在同一臺 RTX PRO 6000 上對三個 Qwen3.8 檢查點做了對比。據帖子自述,整個測試前後用了三週時間,共 10 項測試,三個模型拿到相同的提示詞,各自使用自己 model card 上標註的取樣引數,每項任務只跑一次,結果連同實測影片一併給出。作者還提到,上一次他是單獨測試 Qwen3.8-Flash-Next。
參與對比的三個檢查點分別是 RadixArk/Qwen3.8-27B-NVFP4(dense)、orcarouter/Qwen3.8-27B-Uncensored-NVFP4(dense,去審查微調)和 RadixArk/Qwen3.8-Flash-Next-NVFP4(MoE)。帖子標題把這件事寫成 SGLang/vLLM 新配方對比,但摘要與原文片段並沒有列出具體的測試專案內容、各項得分、延遲或吞吐數字,也沒有說明三者中哪一個表現更好,因此目前能核對的只是測試設定、模型清單和測試條件。
就現有材料看,這件事停在作者釋出實測說明與影片這一步,評測結論本身尚未在報道中體現;由於目前只有這一篇報道,也沒有其他來源的資料可與之對照。
AI 綜合 1 篇報道生成 · 更新於 1 小時前
最新進展作者用三週時間在同一臺 RTX PRO 6000 上,以同一套 10 項測試對比了三個 Qwen3.8 檢查點:RadixArk 27B NVFP4、orcarouter 27B Uncensored NVFP4(去審查微調)和 RadixArk Flash-Next NVFP4(MoE)。每個模型用各自 model card 的取樣引數、每項任務只跑一次,結果與實測影片一併給出。

這件事的報道 點標題看原文
作者用三週時間在同一臺 RTX PRO 6000 上,以同一套 10 項測試對比了三個 Qwen3.8 檢查點:RadixArk 27B NVFP4、orcarouter 27B Uncensored NVFP4(去審查微調)和 RadixArk Flash-Next NVFP4(MoE)。每個模型用各自 model card 的取樣引數、每項任務只跑一次,結果與實測影片一併給出。
想在本地跑 Qwen3.8 的人可参考这份对比
Reddit · LocalLLaMAAI 評分 72
同時在說的其他事
- 659發酵中輝達釋出 64GB 版 DGX Spark,售價 4999 美元8 個來源
- 539新Apple 收緊 macOS 全盤訪問許可權,防範 AI Agent 風險6 個來源
- 476新Meta 開源 Muse Gadgets 韌體與 SDK5 個來源
- 303谷歌釋出 Gemini 4 Argon 模型,定位前沿 AI 能力8 個來源
- 270新Anthropic 投 1 億美元啟動 Claude 工程師學院3 個來源
- 248爆OpenAI DevDay 2026 釋出 Dots、Decisions API 等新品3 個來源
熱度怎麼算的?瞭解口徑收起
熱度按 48 小時內有多少個獨立來源在說這件事算:同一個來源發多條只算一次,並按 24 小時半衰期衰減,所以排前面的是很多人在說的事。
本頁彙總公開訂閱源,標題與摘要由模型整理,版權歸原作者所有;重要資訊請回原文核對。
- 爆
- 討論快速增加
- 新
- 首報 6 小時內
- 發酵中
- 討論仍在增加
