老平臺跑 Qwen3.8 Next:DDR4 加 7900 XTX 約 45-50 t/s
2026/10/03 — 10/03 12:12·1 個來源·1 篇報道
事件概覽
2026 年 10 月 3 日,有使用者在 Reddit 的 LocalLLaMA 版塊分享了一次本地推理測試:在一套使用 DDR4 記憶體、搭配 7900 XTX 顯示卡的老平臺上執行 IQ3_XXS 量化的 Qwen3.8 Next,速度穩定在約 45-50 t/s。該使用者稱,這份 IQ3_XXS 權重略低於 80GB,速度有時會更高,寫程式碼時具體表現取決於 mtp。
據其描述,同一套機器上 Llama CPP 經過調優後最高約為 22.5 t/s,被用來與上述結果作對比。該使用者還表示,在網上看到使用 12GB 和 16GB 顯示卡的使用者有類似結果,而 DDR5 平臺的速度明顯更快。他同時提醒不建議使用 Q2 量化,並稱質量似乎可靠地更好。
AI 綜合 1 篇報道生成 · 更新於 1 小時前
最新進展有使用者在 LocalLLaMA 分享,用 DDR4 記憶體加 7900 XTX 顯示卡執行 IQ3_XXS 量化(略低於 80GB)的 Qwen3.8 Next,速度穩定在約 45-50 t/s,同平臺 Llama CPP 調優後最高約 22.5 t/s。該使用者稱 12GB 和 16GB 顯示卡使用者有類似結果,DDR5 平臺更快,並提醒不建議使用 Q2 量化。
這件事的報道 點標題看原文
有使用者在 LocalLLaMA 分享,用 DDR4 記憶體加 7900 XTX 顯示卡執行 IQ3_XXS 量化(略低於 80GB)的 Qwen3.8 Next,速度穩定在約 45-50 t/s,同平臺 Llama CPP 調優後最高約 22.5 t/s。該使用者稱 12GB 和 16GB 顯示卡使用者有類似結果,DDR5 平臺更快,並提醒不建議使用 Q2 量化。
给显存有限、内存充裕的本地部署玩家一个参考。
Reddit · LocalLLaMAAI 評分 62
同時在說的其他事
- 554輝達釋出 64GB 版 DGX Spark,售價 4999 美元8 個來源
- 539發酵中Apple 收緊 macOS 全盤訪問許可權,防範 AI Agent 風險7 個來源
- 400Meta 開源 Muse Gadgets 韌體與 SDK5 個來源
- 234爆亞馬遜擬將約 80 億美元輝達晶片轉入融資載體3 個來源
- 227Anthropic 投 1 億美元啟動 Claude 工程師學院3 個來源
- 226爆Hugging Face 開源報告生成模型 AstaBrief3 個來源
熱度怎麼算的?瞭解口徑收起
熱度按 48 小時內有多少個獨立來源在說這件事算:同一個來源發多條只算一次,並按 24 小時半衰期衰減,所以排前面的是很多人在說的事。
本頁彙總公開訂閱源,標題與摘要由模型整理,版權歸原作者所有;重要資訊請回原文核對。
- 爆
- 討論快速增加
- 新
- 首報 6 小時內
- 發酵中
- 討論仍在增加
