老平台跑 Qwen3.8 Next:DDR4 加 7900 XTX 约 45-50 t/s
2026/10/03 — 10/03 12:12·1 个来源·1 篇报道
事件概览
2026 年 10 月 3 日,有用户在 Reddit 的 LocalLLaMA 版块分享了一次本地推理测试:在一套使用 DDR4 内存、搭配 7900 XTX 显卡的老平台上运行 IQ3_XXS 量化的 Qwen3.8 Next,速度稳定在约 45-50 t/s。该用户称,这份 IQ3_XXS 权重略低于 80GB,速度有时会更高,写代码时具体表现取决于 mtp。
据其描述,同一套机器上 Llama CPP 经过调优后最高约为 22.5 t/s,被用来与上述结果作对比。该用户还表示,在网上看到使用 12GB 和 16GB 显卡的用户有类似结果,而 DDR5 平台的速度明显更快。他同时提醒不建议使用 Q2 量化,并称质量似乎可靠地更好。
AI 综合 1 篇报道生成 · 更新于 1 小时前
最新进展有用户在 LocalLLaMA 分享,用 DDR4 内存加 7900 XTX 显卡运行 IQ3_XXS 量化(略低于 80GB)的 Qwen3.8 Next,速度稳定在约 45-50 t/s,同平台 Llama CPP 调优后最高约 22.5 t/s。该用户称 12GB 和 16GB 显卡用户有类似结果,DDR5 平台更快,并提醒不建议使用 Q2 量化。
这件事的报道 点标题看原文
有用户在 LocalLLaMA 分享,用 DDR4 内存加 7900 XTX 显卡运行 IQ3_XXS 量化(略低于 80GB)的 Qwen3.8 Next,速度稳定在约 45-50 t/s,同平台 Llama CPP 调优后最高约 22.5 t/s。该用户称 12GB 和 16GB 显卡用户有类似结果,DDR5 平台更快,并提醒不建议使用 Q2 量化。
给显存有限、内存充裕的本地部署玩家一个参考。
Reddit · LocalLLaMAAI 评分 62
同时在说的其他事
- 554英伟达发布 64GB 版 DGX Spark,售价 4999 美元8 个来源
- 539发酵中Apple 收紧 macOS 全盘访问权限,防范 AI Agent 风险7 个来源
- 400Meta 开源 Muse Gadgets 固件与 SDK5 个来源
- 234爆亚马逊拟将约 80 亿美元英伟达芯片转入融资载体3 个来源
- 227Anthropic 投 1 亿美元启动 Claude 工程师学院3 个来源
- 226爆Hugging Face 开源报告生成模型 AstaBrief3 个来源
热度怎么算的?了解口径收起
热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。
本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。
- 爆
- 讨论快速增加
- 新
- 首报 6 小时内
- 发酵中
- 讨论仍在增加
