热点事件持续更新
llama.cpp 编译为 WASM:浏览器本地跑 LLM
2 篇报道1 个报道来源11 小时前更新
先了解这件事
AI 综述
据 AGI Hunt 2026 年 10 月 6 日报道,开发者开源了 Llama.wasm:把 llama.cpp 编译成 WebAssembly,并借助 WebGPU 做端上 GPU 加速,让 LLM 完全在浏览器客户端运行,推理不经任何服务器。报道称该仓库可在任何现代浏览器直接运行,作者将其定位为端侧部署的一条新路径——无需安装、无需后端,隐私数据不出设备。同一来源的报道称这是 LLM 完全在浏览器客户端运行的概念验证(POC),并附有演示视频,推理全部发生在用户设备上。目前公开信息仅停留在概念验证与演示层面,报道未披露所用模型规模、推理速度等具体指标,也未说明该工作与 llama.cpp 上游项目的关系及后续计划。
AI 根据报道生成 · 2 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
10月6日
- AGI Hunt把 llama.cpp 编译成 WASM:纯浏览器端跑 LLM 的概念验证
开发者用 WebGPU 把 llama.cpp 编译成 WASM,做出 LLM 完全在浏览器客户端运行的概念验证(POC),并附上演示视频。该实验中推理全部发生在用户设备上、无需服务器,属于客户端/端侧 LLM 部署方向的技术尝试,对应开源项目 Llama.wasm。
- AGI HuntLlama.wasm 开源:llama.cpp 编译为 WASM 加 WebGPU,浏览器本地运行 LLM
作者开源了 Llama.wasm,一个把 llama.cpp 编译成 WASM 并借助 WebGPU 的概念验证仓库,让 LLM 完全在浏览器客户端运行,推理不经任何服务器。仓库基于 llama.cpp 编译为 WebAssembly,可在任何现代浏览器直接运行,并用 WebGPU 做端上 GPU 加速推理。作者称这是端侧部署的一条新路径,无需安装、无需后端,隐私数据不出设备。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。