AGI Hunt· HankYeomans·· 4 小时前AI 评分27
网友称自托管 GLM 模型在双 RTX 6000 Pro 上跑出 175 tok/s、98% 草稿接受率
AI 导读
网友 HankYeomans 分享本地部署数据:疑似 GLM 模型(写作 GLM-5.3-EX3,型号名待证实)在两块 RTX 6000 Pro 上达到 175 tok/s,搭配投机解码的草稿接受率高达 98%。发帖人自己称这个数字「ridiculous」。该型号名称疑为笔误,数据未经证实。
来源:AGI Hunt · agihunt.info