2060 筆記本用 Strata 跑約 120B 的 Qwen 3.8 Flash Next
2026/10/03 — 10/03 23:12·1 個來源·1 篇報道
事件概覽
2026 年 10 月 3 日,Reddit 的 LocalLLaMA 板塊出現一篇帖子,作者稱在一臺只有 32 GB 記憶體和 6 GB 視訊記憶體的 2060 筆記本上,用 Strata 引擎執行約 120B 引數的 Qwen 3.8 Flash Next(q2_0 量化)。據其描述,在 50k 上下文下解碼速度約為 10 tok/s;執行配置為 4 bit KV cache、無視覺。
作者表示,他原本預期提示處理大約 30 token/s、解碼最多 3 tok/s,理由是完整的 Qwen 3.8 Next 約有 120B 引數(不計 Engrams),而機器只有 32 GB 記憶體,他以為會因 SSD 交換而慢到幾乎停住。實際 10 token/s 的結果讓他認為這個引擎確實名副其實。目前這件事停在該帖的分享階段,沒有更多後續進展。
AI 綜合 1 篇報道生成 · 更新於 2 小時前
最新進展在只有 32 GB 記憶體和 6 GB 視訊記憶體的 2060 筆記本上,用 Strata 引擎跑約 120B 引數的 Qwen 3.8 Flash Next(q2_0 量化),50k 上下文下解碼約 10 tok/s。作者原本預期最多 3 tok/s,實際速度超出預期;配置為 4 bit KV cache、無視覺。
- 熱度指數
- 91
- 獨立來源
- 1
- 報道數
- 1
- 首報
- 4 小時前
這件事的報道 點標題看原文
在只有 32 GB 記憶體和 6 GB 視訊記憶體的 2060 筆記本上,用 Strata 引擎跑約 120B 引數的 Qwen 3.8 Flash Next(q2_0 量化),50k 上下文下解碼約 10 tok/s。作者原本預期最多 3 tok/s,實際速度超出預期;配置為 4 bit KV cache、無視覺。
低配老设备本地跑大模型的实测参考。
同時在說的其他事
- 552發酵中Apple 收緊 macOS 全盤訪問許可權,防範 AI Agent 風險9 個來源
- 392輝達釋出 64GB 版 DGX Spark,售價 4999 美元8 個來源
- 376發酵中Meta 開源 Muse Gadgets 韌體與 SDK6 個來源
- 289Opus 5.5 與 GPT-6 Sol 同日釋出,每任務成本誰更低4 個來源
- 264Anthropic 計劃感恩節前上市,目標 11 月 9 日5 個來源
- 249新爆Aleph Alpha 釋出 Kolibri-1:78B 引數 MoE,支援 1M 上下文3 個來源
熱度怎麼算的?瞭解口徑收起
熱度按 48 小時內有多少個獨立來源在說這件事算:同一個來源發多條只算一次,並按 24 小時半衰期衰減,所以排前面的是很多人在說的事。
本頁彙總公開訂閱源,標題與摘要由模型整理,版權歸原作者所有;重要資訊請回原文核對。
- 爆
- 討論快速增加
- 新
- 首報 6 小時內
- 發酵中
- 討論仍在增加
