热点事件持续更新
llama.cpp 新增决策模型支持
2 篇报道1 个报道来源4 小时前更新
先了解这件事
AI 综述
2026年10月2日22:25,AGI Hunt 报道 llama.cpp server 新增对决策模型的支持,接入方式为 /v1/systemone 端点:使用者输入文本、JSON 或截图等状态,再附上一个带类型的问题,模型在单次前向传播中直接为每个选项返回概率,而不再逐 token 生成文本后再解析,报道称目前已支持 5 个开源模型。同日22:33,AGI Hunt 再发报道,内容基本一致,补充称该支持遵循 TypeSafe Jev 模型引入的 System 规范,并给出性能数据:最小的 144M 模型推理仅需 3 毫秒。两篇报道在端点、输入形式和模型数量上说法一致,未出现矛盾。目前进展为 5 个开源模型可用,最小模型单次前向约 3 毫秒即可完成打分。
AI 根据报道生成 · 3 小时前更新
最新进展10月2日 22:33
新报道补充称其遵循 TypeSafe Jev 的 System 规范,最小 144M 模型推理仅需 3 毫秒。报道时间线
沿着报道,了解事件的不同侧面。
10月2日
- AGI Huntllama.cpp 新增决策模型支持,单次前向快速打分
llama.cpp 新增对决策模型的支持,通过 /v1/systemone 端点提供服务,遵循 TypeSafe Jev 模型引入的 System 规范。用户输入状态(文本、JSON 或截图)与带类型的问题,模型在一次前向传播中即可返回各选项的概率分布,实现快速打分。目前已有 5 个开源模型可用,最小的 144M 模型推理仅需 3 毫秒。
- AGI Huntllama.cpp 新增决策模型:一次前向返回各选项概率,已支持 5 个开源模型
llama.cpp server 通过 /v1/systemone 端点支持决策模型,输入文本、JSON 或截图等状态加带类型的问题后,模型在单次前向传播中为每个选项返回概率,而不再逐 token 生成文本再解析。
本事件热度走势
当前热度 9·可比范围峰值 10(10月2日 23:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。