微調 7B 模型實需 112 GB 視訊記憶體,LoRA 與 QLoRA 為何有效
2026/10/03 — 10/03 12:12·1 個來源·1 篇報道
事件概覽
2026 年 10 月 3 日,DEV Community 的一篇文章算了一筆微調視訊記憶體的賬。文章提出,被問到微調一個 7B 模型需要多少視訊記憶體時,很多人的直覺回答是 fp16 下模型本身佔 14 GB,所以比這多一點就夠了;但文章給出的實際數字約為 112 GB。在這筆賬裡,模型權重只佔 14 GB,其餘約 98 GB 來自梯度、最佳化器狀態和啟用值。
文章稱這套賬目來自 ZeRO 論文。文中沒有把 LoRA 和 QLoRA 描述成技巧,而是說看清這部分視訊記憶體去向之後,它們更像順理成章的選擇。原文片段在開頭把 112 GB 說成「還沒存下任何一個啟用值」之前的數字,隨後又把啟用值列入那 98 GB 的構成,兩處表述略有出入。
截至目前,這件事只有這一篇報道,沒有其他來源給出不同數字或補充說明。
AI 綜合 1 篇報道生成 · 更新於 1 小時前
最新進展按 ZeRO 論文的視訊記憶體賬目,fp16 下微調一個 7B 模型實際需要約 112 GB 視訊記憶體,其中模型權重只佔 14 GB,剩下的約 98 GB 來自梯度、最佳化器狀態和啟用值。看清這筆賬之後,LoRA 和 QLoRA 為什麼有效就不再像技巧,而像顯然的選擇。

這件事的報道 點標題看原文
按 ZeRO 論文的視訊記憶體賬目,fp16 下微調一個 7B 模型實際需要約 112 GB 視訊記憶體,其中模型權重只佔 14 GB,剩下的約 98 GB 來自梯度、最佳化器狀態和啟用值。看清這筆賬之後,LoRA 和 QLoRA 為什麼有效就不再像技巧,而像顯然的選擇。
看懂显存花在哪,判断该全参微调还是上 LoRA。
DEV Community · AIAI 評分 82
同時在說的其他事
- 554輝達釋出 64GB 版 DGX Spark,售價 4999 美元8 個來源
- 539發酵中Apple 收緊 macOS 全盤訪問許可權,防範 AI Agent 風險7 個來源
- 400Meta 開源 Muse Gadgets 韌體與 SDK5 個來源
- 234爆亞馬遜擬將約 80 億美元輝達晶片轉入融資載體3 個來源
- 227Anthropic 投 1 億美元啟動 Claude 工程師學院3 個來源
- 226爆Hugging Face 開源報告生成模型 AstaBrief3 個來源
熱度怎麼算的?瞭解口徑收起
熱度按 48 小時內有多少個獨立來源在說這件事算:同一個來源發多條只算一次,並按 24 小時半衰期衰減,所以排前面的是很多人在說的事。
本頁彙總公開訂閱源,標題與摘要由模型整理,版權歸原作者所有;重要資訊請回原文核對。
- 爆
- 討論快速增加
- 新
- 首報 6 小時內
- 發酵中
- 討論仍在增加
