Hacker News | 📄 原文链接 | 2026-09-03 收录

WebLLM:高性能浏览器内 LLM 推理引擎

来源:github.com — 排名 #12 · 36 分

📋 概述

WebLLM 是一个高性能的浏览器内 LLM 推理引擎,完全在浏览器中以 WebGPU 硬件加速运行,无需任何服务器支持。它完全兼容 OpenAI API,可在本地任意开源模型上使用流式输出、JSON 模式等功能,兼具隐私保护与 GPU 加速,是 MLC LLM 的配套项目,在 GitHub 上已有超过 1.8 万星。

🔑 核心要点

💡 金句

为每个人带来构建 AI 助手的乐趣,并在享受 GPU 加速的同时保护隐私。
← 返回 Hacker News 首页