三个 Qwen3.8 权重在 RTX PRO 6000 上本地实测
2026/10/03 — 10/03 06:11·1 个来源·1 篇报道
事件概览
2026 年 10 月 3 日,Reddit 的 LocalLLaMA 版块出现一篇本地实测帖,作者在同一台 RTX PRO 6000 上对三个 Qwen3.8 检查点做了对比。据帖子自述,整个测试前后用了三周时间,共 10 项测试,三个模型拿到相同的提示词,各自使用自己 model card 上标注的采样参数,每项任务只跑一次,结果连同实测视频一并给出。作者还提到,上一次他是单独测试 Qwen3.8-Flash-Next。
参与对比的三个检查点分别是 RadixArk/Qwen3.8-27B-NVFP4(dense)、orcarouter/Qwen3.8-27B-Uncensored-NVFP4(dense,去审查微调)和 RadixArk/Qwen3.8-Flash-Next-NVFP4(MoE)。帖子标题把这件事写成 SGLang/vLLM 新配方对比,但摘要与原文片段并没有列出具体的测试项目内容、各项得分、延迟或吞吐数字,也没有说明三者中哪一个表现更好,因此目前能核对的只是测试设置、模型清单和测试条件。
就现有材料看,这件事停在作者发布实测说明与视频这一步,评测结论本身尚未在报道中体现;由于目前只有这一篇报道,也没有其他来源的数据可与之对照。
AI 综合 1 篇报道生成 · 更新于 1 小时前
最新进展作者用三周时间在同一台 RTX PRO 6000 上,以同一套 10 项测试对比了三个 Qwen3.8 检查点:RadixArk 27B NVFP4、orcarouter 27B Uncensored NVFP4(去审查微调)和 RadixArk Flash-Next NVFP4(MoE)。每个模型用各自 model card 的采样参数、每项任务只跑一次,结果与实测视频一并给出。

这件事的报道 点标题看原文
作者用三周时间在同一台 RTX PRO 6000 上,以同一套 10 项测试对比了三个 Qwen3.8 检查点:RadixArk 27B NVFP4、orcarouter 27B Uncensored NVFP4(去审查微调)和 RadixArk Flash-Next NVFP4(MoE)。每个模型用各自 model card 的采样参数、每项任务只跑一次,结果与实测视频一并给出。
想在本地跑 Qwen3.8 的人可参考这份对比
Reddit · LocalLLaMAAI 评分 72
同时在说的其他事
- 659发酵中英伟达发布 64GB 版 DGX Spark,售价 4999 美元8 个来源
- 539新Apple 收紧 macOS 全盘访问权限,防范 AI Agent 风险6 个来源
- 476新Meta 开源 Muse Gadgets 固件与 SDK5 个来源
- 303谷歌发布 Gemini 4 Argon 模型,定位前沿 AI 能力8 个来源
- 270新Anthropic 投 1 亿美元启动 Claude 工程师学院3 个来源
- 248爆OpenAI DevDay 2026 发布 Dots、Decisions API 等新品3 个来源
热度怎么算的?了解口径收起
热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。
本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。
- 爆
- 讨论快速增加
- 新
- 首报 6 小时内
- 发酵中
- 讨论仍在增加
