跳到正文
原文
AGI Hunt· indiealexh·· 3 小时前AI 评分38

RTX 5090 混搭 Intel Arc B70 跑本地 LLM:带宽减半换大上下文值不值

5090 混搭 Intel Arc B70 跑本地模型:带宽减半换大上下文值不值

AI 导读

一位 RTX 5090 用户低价购入 Intel Arc B70,想用其显存扩展本地 LLM 上下文,实测把日常编码辅助用的 Qwen3 27B Q4KXL 拆分到 5090 + B70 双卡后,为获得完整上下文吞吐量减半,瓶颈是 B70 显存带宽远低于 5090。他在帖中求助:该用 B70 单独跑小模型分流任务,还是接受降速换取更大上下文,并希望有异构 GPU 组合经验的人分享。

来源:AGI Hunt · agihunt.info