AGI Hunt· indiealexh·· 3 小时前AI 评分38
RTX 5090 混搭 Intel Arc B70 跑本地 LLM:带宽减半换大上下文值不值
5090 混搭 Intel Arc B70 跑本地模型:带宽减半换大上下文值不值
AI 导读
一位 RTX 5090 用户低价购入 Intel Arc B70,想用其显存扩展本地 LLM 上下文,实测把日常编码辅助用的 Qwen3 27B Q4KXL 拆分到 5090 + B70 双卡后,为获得完整上下文吞吐量减半,瓶颈是 B70 显存带宽远低于 5090。他在帖中求助:该用 B70 单独跑小模型分流任务,还是接受降速换取更大上下文,并希望有异构 GPU 组合经验的人分享。
来源:AGI Hunt · agihunt.info