EN
~/home / GitHub
GitHub · Python

triton-inference-server/server

NVIDIA Triton推理服务器,为云和边缘场景提供高性能、可扩展的AI模型推理服务,支持多框架、动态批处理与模型版本管理。
⭐10.8k5/天
为什么值得关注

统一多框架AI推理部署难题,显著提升GPU利用率与服务吞吐量,是生产环境AI服务的标杆解决方案。

AI基础设施云原生部署
访问 GitHub 页面 →
分享到 X
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布

同类产品

mvanhorn/last30days-skillayghri/i-have-adhdbojieli/ai-agent-bookNanmiCoder/MediaCrawlerGraphify-Labs/graphifyXiaoYouChR/Ghost-Downloader-3