iPhone 當第二塊 GPU,Qwen 3.8 27B 預填充提速 29–44%
2026/10/03 — 10/03 03:11·1 個來源·1 篇報道
事件概覽
2026 年 10 月 3 日,Reddit 的 LocalLLaMA 版塊出現一則來自開發者的實踐記錄:他把一臺 iPhone 17 Pro Max 當作第二塊 GPU,接到一臺 24GB 記憶體的 M4 Pro MacBook 上,用來分擔 Qwen 3.8 27B(IQ4_XS 量化)的部分上下文視窗。按作者給出的數字,端到端預填充速度因此提升 29–44%。
作者在說明裡交代了做這件事的緣由:在他的 24GB M4 Pro MacBook 上,agent 每讀一個檔案或工具返回結果都要等待,即便把 wired limit 提高到 20480,在 Qwen 3.8 27B(IQ4_XS)旁邊也只能放下 64k 的 8-bit 上下文。
他同時加了一段免責宣告,提醒讀者手機上顯示的預填充 t/s 只統計了該裝置所承載的那些層,並不能代表整體速度,真正的準確數值是端到端預填充速率。作者表示已經在修正這個顯示問題,並強調文中列出的數字對端到端預填充速率是準確的。截至這篇材料,這件事停在該開發者公佈資料並說明顯示口徑待修正的階段。
AI 綜合 1 篇報道生成 · 更新於 2 小時前
最新進展有開發者把 iPhone 17 Pro Max 當作 24GB M4 Pro MacBook 的第二塊 GPU,讓它承載 Qwen 3.8 27B(IQ4_XS)的部分上下文視窗,端到端預填充速度提升 29–44%。作者補充說,手機上顯示的預填充 t/s 只統計它承載的層,端到端數字才是準確值,相關顯示正在修正。

- 熱度指數
- 89
- 獨立來源
- 1
- 報道數
- 1
- 首報
- 4 小時前
這件事的報道 點標題看原文
有開發者把 iPhone 17 Pro Max 當作 24GB M4 Pro MacBook 的第二塊 GPU,讓它承載 Qwen 3.8 27B(IQ4_XS)的部分上下文視窗,端到端預填充速度提升 29–44%。作者補充說,手機上顯示的預填充 t/s 只統計它承載的層,端到端數字才是準確值,相關顯示正在修正。
想用手机给本地模型加算力的人可参考这套做法
同時在說的其他事
- 593爆輝達釋出 64GB 版 DGX Spark,售價 4999 美元7 個來源
- 466新Apple 收緊 macOS 全盤訪問許可權,防範 AI Agent 風險5 個來源
- 372谷歌釋出 Gemini 4 Argon 模型,定位前沿 AI 能力10 個來源
- 262爆OpenAI DevDay 2026 釋出 Dots、Decisions API 等新品3 個來源
- 248爆Suno 上線語音生成功能,支援旁白與配樂3 個來源
- 212爆微軟釋出 MAI-Transcribe-2-Streaming 即時轉寫模型3 個來源
熱度怎麼算的?瞭解口徑收起
熱度按 48 小時內有多少個獨立來源在說這件事算:同一個來源發多條只算一次,並按 24 小時半衰期衰減,所以排前面的是很多人在說的事。
本頁彙總公開訂閱源,標題與摘要由模型整理,版權歸原作者所有;重要資訊請回原文核對。
- 爆
- 討論快速增加
- 新
- 首報 6 小時內
- 發酵中
- 討論仍在增加
