# 边缘计算
31 个相关产品 · 中文解读 · 按热度排序
boxlite
Boxlite 是一个极轻量的微虚拟机,专为 AI 代理设计,可嵌入本地笔记本电脑,也能扩展为 AI 代理云,实现本地与云端协同运行。
needle
一个仅 2600 万参数的超轻量函数调用模型,可在极小设备(如嵌入式芯片)上运行,实现边缘端 AI 功能。
Dual YOLOv8n UAV Detection on RK3588S at 42 FPS Using NPU
在RK3588S芯片上实现42FPS的双YOLOv8n无人机检测,专为边缘AI硬件优化,适合无人机安防与实时监控场景
cactus
面向移动端与可穿戴设备的低延迟 AI 引擎,专为在资源受限设备上高效运行 AI 模型而设计,解决边缘端 AI 推理性能瓶颈
Open-source Cloudflare deployed agent native task management and wiki
一个开源的、可部署在 Cloudflare 上的原生任务管理与知识库系统,允许开发者在边缘计算环境中运行自动化工作流和协作工具。
Tokenstead, find AI models for your hardware
Tokenstead 帮助用户根据硬件设备性能快速筛选适配的 AI 模型,解决边缘计算中模型部署的匹配难题,适合开发者和嵌入式系统工程师。
Sapient
纯Rust编写的轻量级边缘推理引擎,支持小语言模型、语音识别与实时语音合成,可在笔记本或树莓派上本地运行,无需Python/Docker/CUDA
TZRO – A Free Local AI Task Offloader
一款免费的本地AI任务卸载工具,让设备在本地运行AI任务时更高效,降低对云端依赖和延迟问题
WiFi-LLM
WiFi-LLM 是一个利用本地大模型在WiFi环境下运行的轻量级AI应用,实现离线推理与本地化数据处理,解决云端AI依赖网络与隐私泄露的痛点。
I built a hypervisor and client for inference on consumer compute
构建了一个可在消费级设备上运行的推理虚拟机及客户端,让个人电脑也能高效运行大模型推理
Posthawk
Posthawk 是一个基于边缘计算的事务性邮件服务,专为 Next.js、Vercel 和 Cloudflare Workers 构建,支持开源自托管,帮助开发者快速集成高可靠邮
lightseekorg/tokenspeed
超轻量级LLM推理引擎,追求极致速度,适合在边缘设备或高并发场景下快速部署大模型推理服务。
alibaba/MNN
阿里巴巴自研的轻量级高性能推理引擎,专为设备端大模型与边缘 AI 优化,支持低延迟部署
qualcomm/GenieX
在高通设备(NPU/GPU/CPU)上轻松运行前沿大模型与视觉语言模型,代码简洁,适合边缘AI开发者。
Dual YOLOv8n UAV Detection on RK3588S at 42 FPS Using NPU
在RK3588S芯片上实现双YOLOv8n无人机检测,利用NPU加速达到42 FPS,适合边缘AI与无人机监控应用,亮点是轻量模型与高性能硬件的高效结合
I wrote a 1-bit WebGPU runtime to run a 1.7B LLM in the browser
1-bit WebGPU 运行时项目在浏览器中运行 1.7B 参数的 LLM,仅用极低内存和计算资源实现本地大模型推理,让轻量级 AI 应用在前端落地成为可能。
SOCBench – an open benchmark for AI on SoC tasks
面向 AI 在片上系统(SoC)任务上的性能评估开源基准,推动边缘 AI 的标准化测试
I ported llama.cpp to Apple Watch and ran a 0.8B LLM locally
将 llama.cpp 移植到 Apple Watch,实现在手表上本地运行 0.8B 参数的 LLM,实现离线 AI 交互。
I replaced Whisper with Parakeet TDT on a $55/month CPU server
Parakeet TDT 是一个轻量级语音识别模型,可在仅 55 美元/月的 CPU 服务器上替代 Whisper,显著降低部署成本。
google-ai-edge/LiteRT
Google推出的轻量级边缘AI推理框架LiteRT,作为TensorFlow Lite的继任者,专为边缘设备优化高性能ML与生成式AI部署
google-ai-edge/LiteRT-LM
谷歌推出的面向边缘设备的高性能大语言模型推理框架,支持低延迟、高吞吐的本地 LLM 部署,适用于手机、IoT 等资源受限设备
cactus-compute/needle
一个仅 26MB 的超轻量级函数调用模型,可在资源极低的设备(如嵌入式)上运行。
cactus-compute/cactus
面向移动端与可穿戴设备的低延迟 AI 推理引擎,支持轻量化模型高效运行,适合边缘设备上的实时 AI 应用。
WasmEdge/WasmEdge
高性能 WebAssembly 运行时,专为云原生、边缘计算和去中心化应用设计,支持多种场景下的轻量执行。
Goku – WASM (wllama)-powered LLM inference and model manager
基于 WASM(wllama)的 LLM 推理与模型管理工具,可在浏览器或边缘设备上运行轻量级大模型。
tphakala/birdnet-go
BirdNET-Go 是一个可在树莓派上长期运行的本地化野生动物声音分析系统,支持多模型 AI 推理,用于实时识别鸟类、蝙蝠等生物声音,适合生态研究者与环保爱好者。
zap - agent media runtime
Vercel Day 发布的代理媒体运行时,支持在边缘计算环境中运行 AI 代理处理多媒体任务,如图像、音频生成与分析。
WiFi-LLM
WiFi-LLM 是一个将大语言模型运行在 WiFi 网络中的实验性项目,通过无线网络实现跨设备的轻量级 AI 服务共享,适合开发者探索新型边缘计算场景。
cloudflare/workerd
Cloudflare Workers Runtime 是基于 Wasm 的 JavaScript 运行时,支持在边缘节点执行轻量级函数,用于构建低延迟、高可扩展的 Web 应用。
itayinbarr/little-coder
专为小型大模型优化的轻量级运行时框架,提升小模型在资源受限环境下的推理效率与响应速度,适合边缘部署
World's First(?) Underwhelming AMD Ryzen AI Halo Cluster
一个基于AMD Ryzen AI芯片的本地化小型大模型推理集群,主打低功耗与边缘部署,适合开发者在本地运行轻量级AI模型,虽性能一般但开创性地尝试了AI芯片集群化部署。