~/home / Hacker News
Hacker News · Show HN

Run a 120B-parameter MoE on Android mid-range phone CPU-only llama.cpp

在中端安卓手机 CPU 上运行 1200 亿参数的 MoE 大模型,仅用 llama.cpp 实现,适合移动 AI 爱好者与边缘计算开发者
▲1
为什么值得关注

突破移动端运行超大规模模型的性能瓶颈,证明 LLM 可在无 GPU 的设备上高效运行,推动边缘 AI 普及

AI移动端大模型效率
访问 Hacker News 页面 →
分享到 X
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布

同类产品

Physically accurate black hole you can put in your roomReverse MinesweeperI mapped every US golf courseA browser-based video editor that renders videos directly with FFmpegManaging on-premise servers without KubernetesBrolly, a plain-text weather forecast site