基于 WASM(wllama)的 LLM 推理引擎与模型管理工具,可在浏览器中运行轻量级大模型,适合本地化、低延迟推理场景
7 票
为什么值得关注
访问 Show HN 页面 →
将 LLM 推理下沉到浏览器端,实现无服务器部署与隐私保护,是 Web3/AI 前端融合的重要尝试
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布
将 LLM 推理下沉到浏览器端,实现无服务器部署与隐私保护,是 Web3/AI 前端融合的重要尝试