MegaCapybara 釋出 RTX5090 推理引擎稱速度翻倍
2026/10/03 — 10/03 10:12·1 個來源·1 篇報道
事件概覽
2026 年 10 月 3 日,一位開發者在 Reddit 的 LocalLLaMA 版塊公佈了一款名為 MegaCapybara 的推理引擎。據其介紹,這款引擎是專門為 RTX5090 打造的,當前主要面向 Qwen3.8 27B 這一個模型,作者表示後續會支援更多模型。引擎程式碼釋出在 GitHub,權重放在 Hugging Face。
作者給出的核心說法是速度:MegaCapybara 的解碼速度約為 Ninfer 的兩倍,而 Ninfer 在此之前是 RTX5090 上的 SOTA 引擎,這一倍數在單任務和多工併發兩種情況下都成立。具體數字方面,材料稱單路可達 500+ t/s,短時爆發能到 650 t/s,12 路併發時最高 2600 t/s;原文在提到 2600 t/s 時用的說法是「如果一切條件都剛好合適」,而報道摘要把它歸到 12 路併發的場景下,兩處表述並不完全一致。除此之外,MegaCapybara 支援 800k 上下文,並帶有 VRAM-RAM-磁碟三級快取管理、Loop Guard 以及圖形介面。
目前這件事停在新專案公佈這一步:上述速度數字均為作者自述,材料中沒有給出測試條件,也沒有第三方復現或獨立評測,MegaCapybara 相對 Ninfer 是否真的達到兩倍,尚無法從現有資訊中確認。
AI 綜合 1 篇報道生成 · 更新於 1 小時前
最新進展開發者釋出 MegaCapybara,一款專為 RTX5090 打造、面向 Qwen3.8 27B 的推理引擎,作者稱其解碼速度約為此前 RTX5090 上 SOTA 的 Ninfer 兩倍。單路編碼可達 500+ t/s,12 路併發時最高 2600 t/s,支援 800k 上下文,並帶 VRAM-RAM-磁碟快取管理、Loop Guard 和圖形介面。

這件事的報道 點標題看原文
開發者釋出 MegaCapybara,一款專為 RTX5090 打造、面向 Qwen3.8 27B 的推理引擎,作者稱其解碼速度約為此前 RTX5090 上 SOTA 的 Ninfer 兩倍。單路編碼可達 500+ t/s,12 路併發時最高 2600 t/s,支援 800k 上下文,並帶 VRAM-RAM-磁碟快取管理、Loop Guard 和圖形介面。
想在单张 RTX5090 上跑本地大模型的可以关注这个引擎。
Reddit · LocalLLaMAAI 評分 78
同時在說的其他事
- 587發酵中輝達釋出 64GB 版 DGX Spark,售價 4999 美元8 個來源
- 571發酵中Apple 收緊 macOS 全盤訪問許可權,防範 AI Agent 風險7 個來源
- 424爆Meta 開源 Muse Gadgets 韌體與 SDK5 個來源
- 248爆亞馬遜擬將約 80 億美元輝達晶片轉入融資載體3 個來源
- 241爆Anthropic 投 1 億美元啟動 Claude 工程師學院3 個來源
- 239爆Hugging Face 開源報告生成模型 AstaBrief3 個來源
熱度怎麼算的?瞭解口徑收起
熱度按 48 小時內有多少個獨立來源在說這件事算:同一個來源發多條只算一次,並按 24 小時半衰期衰減,所以排前面的是很多人在說的事。
本頁彙總公開訂閱源,標題與摘要由模型整理,版權歸原作者所有;重要資訊請回原文核對。
- 爆
- 討論快速增加
- 新
- 首報 6 小時內
- 發酵中
- 討論仍在增加
