微调 7B 模型实需 112 GB 显存,LoRA 与 QLoRA 为何有效
2026/10/03 — 10/03 12:12·1 个来源·1 篇报道
事件概览
2026 年 10 月 3 日,DEV Community 的一篇文章算了一笔微调显存的账。文章提出,被问到微调一个 7B 模型需要多少显存时,很多人的直觉回答是 fp16 下模型本身占 14 GB,所以比这多一点就够了;但文章给出的实际数字约为 112 GB。在这笔账里,模型权重只占 14 GB,其余约 98 GB 来自梯度、优化器状态和激活值。
文章称这套账目来自 ZeRO 论文。文中没有把 LoRA 和 QLoRA 描述成技巧,而是说看清这部分显存去向之后,它们更像顺理成章的选择。原文片段在开头把 112 GB 说成「还没存下任何一个激活值」之前的数字,随后又把激活值列入那 98 GB 的构成,两处表述略有出入。
截至目前,这件事只有这一篇报道,没有其他来源给出不同数字或补充说明。
AI 综合 1 篇报道生成 · 更新于 1 小时前
最新进展按 ZeRO 论文的显存账目,fp16 下微调一个 7B 模型实际需要约 112 GB 显存,其中模型权重只占 14 GB,剩下的约 98 GB 来自梯度、优化器状态和激活值。看清这笔账之后,LoRA 和 QLoRA 为什么有效就不再像技巧,而像显然的选择。

这件事的报道 点标题看原文
按 ZeRO 论文的显存账目,fp16 下微调一个 7B 模型实际需要约 112 GB 显存,其中模型权重只占 14 GB,剩下的约 98 GB 来自梯度、优化器状态和激活值。看清这笔账之后,LoRA 和 QLoRA 为什么有效就不再像技巧,而像显然的选择。
看懂显存花在哪,判断该全参微调还是上 LoRA。
DEV Community · AIAI 评分 82
同时在说的其他事
- 554英伟达发布 64GB 版 DGX Spark,售价 4999 美元8 个来源
- 539发酵中Apple 收紧 macOS 全盘访问权限,防范 AI Agent 风险7 个来源
- 400Meta 开源 Muse Gadgets 固件与 SDK5 个来源
- 234爆亚马逊拟将约 80 亿美元英伟达芯片转入融资载体3 个来源
- 227Anthropic 投 1 亿美元启动 Claude 工程师学院3 个来源
- 226爆Hugging Face 开源报告生成模型 AstaBrief3 个来源
热度怎么算的?了解口径收起
热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。
本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。
- 爆
- 讨论快速增加
- 新
- 首报 6 小时内
- 发酵中
- 讨论仍在增加
