跳到正文
原文
AGI Hunt· HankYeomans·· 4 小时前AI 评分27

网友称自托管 GLM 模型在双 RTX 6000 Pro 上跑出 175 tok/s、98% 草稿接受率

AI 导读

网友 HankYeomans 分享本地部署数据:疑似 GLM 模型(写作 GLM-5.3-EX3,型号名待证实)在两块 RTX 6000 Pro 上达到 175 tok/s,搭配投机解码的草稿接受率高达 98%。发帖人自己称这个数字「ridiculous」。该型号名称疑为笔误,数据未经证实。

来源:AGI Hunt · agihunt.info