VIDRAFT 发布 POCKET-Darwin-180B 量化版
2026/10/03 — 10/03 07:11·1 个来源·1 篇报道
事件概览
2026 年 10 月 3 日,DEV Community 的 AI 栏目报道,VIDRAFT 发布了 POCKET-Darwin-180B。这是其 Darwin-180B-RSI 前沿模型的 4-bit GGUF 量化版本,兼容 llama.cpp,可在纯 CPU 的消费级设备上运行,包括没有 GPU 的笔记本和迷你主机,不需要企业级 GPU 集群。
报道称,该版本通过稀疏 MoE 路由和 graft 量化实现压缩:原本 360 GB 的 BF16 模型被压到 111 GB,且仅由 4 个文件组成,参数规模为 180B。
目前可核对到的信息止于此:发布方 VIDRAFT、模型名 POCKET-Darwin-180B、其来源模型 Darwin-180B-RSI、4-bit GGUF 量化方式、兼容 llama.cpp、压缩前后的 360 GB 与 111 GB、4 个文件,以及可在纯 CPU 设备上运行。报道没有给出最低硬件配置、推理速度或任何评测数据,也没有说明该版本与 Darwin-180B-RSI 的发布先后关系,这些在现有材料中均无从确认。
AI 综合 1 篇报道生成 · 更新于 2 小时前
最新进展VIDRAFT 发布 POCKET-Darwin-180B,这是其 Darwin-180B-RSI 模型的 4-bit GGUF 量化版本,兼容 llama.cpp,可在纯 CPU 笔记本和迷你主机上运行,无需 GPU 集群。它通过稀疏 MoE 路由和 graft 量化,把 360 GB 的 BF16 模型压到 111 GB、仅 4 个文件。

这件事的报道 点标题看原文
VIDRAFT 发布 POCKET-Darwin-180B,这是其 Darwin-180B-RSI 模型的 4-bit GGUF 量化版本,兼容 llama.cpp,可在纯 CPU 笔记本和迷你主机上运行,无需 GPU 集群。它通过稀疏 MoE 路由和 graft 量化,把 360 GB 的 BF16 模型压到 111 GB、仅 4 个文件。
关注本地跑大模型的人可看量化与 MoE 的实际数字。
DEV Community · AIAI 评分 76
同时在说的其他事
- 640发酵中英伟达发布 64GB 版 DGX Spark,售价 4999 美元8 个来源
- 623爆Apple 收紧 macOS 全盘访问权限,防范 AI Agent 风险7 个来源
- 463新Meta 开源 Muse Gadgets 固件与 SDK5 个来源
- 270谷歌发布 Gemini 4 Argon 模型,定位前沿 AI 能力7 个来源
- 263爆Anthropic 投 1 亿美元启动 Claude 工程师学院3 个来源
- 241爆OpenAI DevDay 2026 发布 Dots、Decisions API 等新品3 个来源
热度怎么算的?了解口径收起
热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。
本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。
- 爆
- 讨论快速增加
- 新
- 首报 6 小时内
- 发酵中
- 讨论仍在增加
