HaiAI123

全球AI工具精選導航

爆行業動態
↑ 159%

Strata 讓 8GB 視訊記憶體電腦跑千億引數大模型

2026/10/09 — 10/10 18:20·2 個來源(全部)·3 篇報道(全部)·入選 10-10 日報

核心速覽 (Key Takeaways)

  • 小眾軟體實測顯示,Strata 可在僅 8GB 視訊記憶體的普通電腦上執行千億引數大模型,已在 RTX 5070、RTX 3060、RTX 4060 Ti、RX 9070 XT、RX 9060 XT、RX 7800 XT、RTX 3090 及更早的 Quadro 等顯示卡上驗證可…
  • 此前掘金的技術文章與教程記錄的是在單張 RTX 5090(32GB 視訊記憶體)上執行 125B MoE 大模型的安裝、驗證與基準測試流程,驅動版本為 617.14。

事件背景與詳細解讀

2026 年 10 月 8 日,作者吳佳浩在一篇技術文章中介紹了 Strata 方案,稱其能在單張 RTX 5090(32GB 視訊記憶體)上執行 125B 引數的 MoE 大模型,測試環境為 RTX 5090 搭配 617 版驅動。文章把這一做法描述為將原本屬於伺服器級的 MoE 推理拉進普通 PC。該文於 10 月 9 日 22:51 釋出在掘金。

隨後在 10 月 10 日 01:12,同一作者又在掘金髮布了一篇教程,記錄在單張 RTX 5090(32GB 視訊記憶體)上執行 125B 大模型的完整流程,覆蓋安裝、驗證與基準測試三部分,並給出更具體的測試環境,包括驅動版本 617.14 等資訊。

10 月 10 日 16:44,小眾軟體發文稱,經其實測,工具 Strata 可以在只有 8GB 視訊記憶體的普通電腦上執行千億引數大模型,並已在 RTX 5070、RTX 3060、RTX 4060 Ti、RX 9070 XT、RX 9060 XT、RX 7800 XT、RTX 3090 以及更早的 Quadro 等顯示卡上驗證可行。該報道認為,這意味著本地執行超大模型的顯示卡門檻明顯降低。目前公開資訊停在這一步:Strata 的可行性已由上述報道給出,但材料中未提及該方案的釋出方、具體實現細節或後續計劃。

AI 綜合 3 篇報道生成 · 更新於 3 小時前

最新進展據小眾軟體實測,工具 Strata 可以在只有 8GB 視訊記憶體的普通電腦上執行千億引數大模型,已在 RTX 5070、RTX 3060、RTX 4060 Ti、RX 9070 XT、RX 9060 XT、RX 7800 XT、RTX 3090 以及更早的 Quadro 等顯示卡上驗證可行。這意味著本地跑超大模型的顯示卡門檻明顯降低。

24 小時熱度熱度指數 145 · 峰值 163 · 4 小時前
24 小時前現在

這件事的報道 點標題看原文

今天
  1. 據小眾軟體實測,工具 Strata 可以在只有 8GB 視訊記憶體的普通電腦上執行千億引數大模型,已在 RTX 5070、RTX 3060、RTX 4060 Ti、RX 9070 XT、RX 9060 XT、RX 7800 XT、RTX 3090 以及更早的 Quadro 等顯示卡上驗證可行。這意味著本地跑超大模型的顯示卡門檻明顯降低。

    想在本地跑大模型的使用者可據此判斷自家顯示卡夠不夠。

    小众软件AI 評分 64
  2. 一篇教程記錄了在單張 RTX 5090(32GB 視訊記憶體)上執行 125B 大模型的完整流程,覆蓋安裝、驗證與基準測試三部分。作者給出了具體測試環境,包括驅動版本 617.14 等資訊。

    想用消費級顯示卡跑大模型的可直接照做

    掘金AI 評分 65
昨天
  1. 一篇技術文章介紹 Strata 方案如何在單張 RTX 5090(32GB 視訊記憶體)上執行 125B 引數的 MoE 大模型,測試環境為 RTX 5090 搭配 617 版驅動。作者吳佳浩稱,這套做法把原本屬於伺服器級的 MoE 推理拉進了普通 PC。

    想在本機跑大 MoE 的讀者可先看這份配置與思路。

    掘金AI 評分 61

同時在說的其他事

熱度怎麼算的?瞭解口徑

熱度按 48 小時內有多少個獨立來源在說這件事算:同一個來源發多條只算一次,並按 24 小時半衰期衰減,所以排前面的是很多人在說的事。

本頁彙總公開訂閱源,標題與摘要由模型整理,版權歸原作者所有;重要資訊請回原文核對。如權利人認為相關標題或摘要侵權,請通過頁尾聯絡郵箱提供具體頁面與權利依據,我們核實後會及時刪除或替換。

爆
討論快速增加
新
首報 6 小時內
發酵中
討論仍在增加

回 AI 行業動態榜 →