开发者发布 Basalt 推理引擎,面向 Blackwell 深度调优
2026/10/10 — 10/10 23:19·1 个来源(全部)·1 篇报道(全部)
核心速览 (Key Takeaways)
- 一位开发者发布 Basalt,这是一个基于 Strata 分支深度调优的推理引擎,目前只支持 Qwen3.8 Flash-Next 与 Blackwell 架构,包括 5090 + 5060 Ti 双卡配置。
- 作者称同等权重下速度最高可达原版 Strata 的 2.6 倍,实测 665 tok/s 结构化输出、354 tok/s 散文输出,64k 上下文预填充 7317。
事件背景与详细解读
2026 年 10 月 10 日,一位开发者在 Reddit 的 LocalLLaMA 版块发布了一个名为 Basalt 的推理引擎。据其介绍,Basalt 基于 Strata 的一个分支做了深度调优,定位为专用引擎,只支持 Qwen3.8 Flash-Next 与 Blackwell 架构,包括 5090 加 5060 Ti 这类双卡配置;作者自己的硬件为 5090 + 5060 Ti,搭配 9950X、32GB DDR5 内存。
在性能方面,作者称 Basalt 在相同权重下最高可达原版 Strata 的 2.6 倍吞吐。他给出的实测数字包括:结构化输出 665 tok/s、散文输出 354 tok/s,64k 上下文预填充为 7317,量化使用 IQ3_XXS,功耗 400 W。
目前该引擎仅由作者本人公布,报道中未提及发布时间表、开源方式或第三方验证情况,也没有其他来源对其速度数据作出回应。
AI 综合 1 篇报道生成 · 更新于 3 小时前
最新进展一位开发者发布 Basalt,这是基于 Strata 分支深度调优的推理引擎,只支持 Qwen3.8 Flash-Next 与 Blackwell 架构,包括 5090 + 5060 Ti 这类双卡配置。作者称其速度最高可达同权重下原版 Strata 的 2.6 倍,实测 665 tok/s 结构化输出、354 tok/s 散文输出,64k 上下文预填充 7317,IQ3_XXS、400 W。
相关 AI 工具
- 热度指数
- 61
- 全部来源
- 1
- 全部报道
- 1
- 首报
- 18 小时前
这件事的报道 点标题看原文
一位开发者发布 Basalt,这是基于 Strata 分支深度调优的推理引擎,只支持 Qwen3.8 Flash-Next 与 Blackwell 架构,包括 5090 + 5060 Ti 这类双卡配置。作者称其速度最高可达同权重下原版 Strata 的 2.6 倍,实测 665 tok/s 结构化输出、354 tok/s 散文输出,64k 上下文预填充 7317,IQ3_XXS、400 W。
自建本地推理引擎的吞吐参考
Reddit · LocalLLaMAAI 评分 53
同时在说的其他事
- 热度指数 3340G 显存 LoRA 微调 Qwen3.8-Flash-Next1 个来源
- 热度指数 86新用户用 Claude Opus 5.5 为 Qwen3.8-27B 写 CUDA megakernel 提速 1.9 倍1 个来源
- 热度指数 97Qwen 开源 Qwen-Image-2.1-Turbo 图像模型2 个来源
- 热度指数 43Qwen3.8-27B 本地实测投机解码达 159 tok/s1 个来源
- 热度指数 28Atomic Agent Desktop 开源上线,可在本地运行 Qwen 和 Gemma1 个来源
热度怎么算的?了解口径收起
热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。
本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。如权利人认为相关标题或摘要侵权,请通过页尾联系邮箱提供具体页面与权利依据,我们核实后会及时删除或替换。
- 爆
- 讨论快速增加
- 新
- 首报 6 小时内
- 发酵中
- 讨论仍在增加
