AGI Hunt· BLUECOW009·2026-10-06 14:19· 6 小时前AI 评分274090 跑 Qwen 3.8 本地模型,上下文窗口约 32k 就爆显存4090 跑 Qwen 本地模型,上下文窗口约 32k 就爆显存AI 导读用户称在 4090 上运行 Qwen 3.8 时,上下文窗口只能开到约 32k 就会耗尽显存,对实际工作来说很受限。相关讨论指出,多数人没意识到本地运行并非可以无限扩展,长上下文本地化存在硬性物理限制。来源:AGI Hunt · agihunt.info#教程/实践#端侧#部署/工程查看事件全部后续