EN
~/home / GitHub
GitHub · C++

ggml-org/llama.cpp

llama.cpp 是一个用 C/C++ 实现的本地 LLM 推理框架,支持在 CPU 上运行 Llama 等大模型,无需 GPU,适合边缘设备和隐私敏感场景。
⭐121.9k🔥 +85 近1日
为什么值得关注

在无 GPU 环境下实现大模型本地推理,兼顾性能与隐私,是边缘 AI 推理的标杆项目。

AILLM基础设施CLI
访问 GitHub 页面 →
分享到 X
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布

同类产品

amnezia-vpn/amnezia-clientocornut/imguimicrosoft/onnxruntimevicinaehq/vicinaecifertech/ESP32-DIVFreeCAD/FreeCAD