跳到正文
热点事件持续更新

llama.cpp 编译为 WASM:浏览器本地跑 LLM

2 篇报道1 个报道来源11 小时前更新

先了解这件事

AI 综述

据 AGI Hunt 2026 年 10 月 6 日报道,开发者开源了 Llama.wasm:把 llama.cpp 编译成 WebAssembly,并借助 WebGPU 做端上 GPU 加速,让 LLM 完全在浏览器客户端运行,推理不经任何服务器。报道称该仓库可在任何现代浏览器直接运行,作者将其定位为端侧部署的一条新路径——无需安装、无需后端,隐私数据不出设备。同一来源的报道称这是 LLM 完全在浏览器客户端运行的概念验证(POC),并附有演示视频,推理全部发生在用户设备上。目前公开信息仅停留在概念验证与演示层面,报道未披露所用模型规模、推理速度等具体指标,也未说明该工作与 llama.cpp 上游项目的关系及后续计划。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. AGI Hunt
    把 llama.cpp 编译成 WASM:纯浏览器端跑 LLM 的概念验证

    开发者用 WebGPU 把 llama.cpp 编译成 WASM,做出 LLM 完全在浏览器客户端运行的概念验证(POC),并附上演示视频。该实验中推理全部发生在用户设备上、无需服务器,属于客户端/端侧 LLM 部署方向的技术尝试,对应开源项目 Llama.wasm。

  2. AGI Hunt
    Llama.wasm 开源:llama.cpp 编译为 WASM 加 WebGPU,浏览器本地运行 LLM

    作者开源了 Llama.wasm,一个把 llama.cpp 编译成 WASM 并借助 WebGPU 的概念验证仓库,让 LLM 完全在浏览器客户端运行,推理不经任何服务器。仓库基于 llama.cpp 编译为 WebAssembly,可在任何现代浏览器直接运行,并用 WebGPU 做端上 GPU 加速推理。作者称这是端侧部署的一条新路径,无需安装、无需后端,隐私数据不出设备。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。