# 成本优化
35 个相关产品 · 中文解读 · 按热度排序
Frugon – Find which LLM calls a cheaper model could handle (local, MIT)
一个本地运行的工具,能识别哪些LLM请求可由更便宜的模型替代,帮助开发者节省API成本,适合成本敏感型AI项目。
Foreman, a self-hosted LLM gateway for cost aware model routing
Foreman是一个自托管的LLM网关,支持按成本智能路由不同大模型,帮助团队优化推理成本与性能平衡,适合对API成本敏感的AI应用开发者
50 Ultra-Cheap AI APIs
精选50个合法且兼容OpenAI的廉价AI API服务商,提供Claude、GPT、Gemini等模型的低价替代方案,帮助开发者节省AI成本
AI Video Cost Calculator
AI Video Cost Calculator 是一款对比多平台 AI 视频生成服务真实价格的工具,帮助用户在使用前预估成本,避免预算超支,支持 Veo、Runway、Pika
ReasoningDensity
上传大模型使用数据导出文件,即可在浏览器内分析 token 浪费、模型过度使用和失败请求成本,无需上传数据或提供 API 密钥。
PXINK
一个纯前端的AI API成本优化工具,通过智能压缩图像尺寸来降低视觉模型调用费用,帮助开发者节省AI支出,适合AI应用开发者。
CacheCatch
CacheCatch 可审计 LLM 提示词缓存效率,识别缓存失效点并优化提示结构,帮助开发者降低大模型调用成本,特别适配 LangSmith、Langfuse 等主流AI开发平台
Prompt Compass
一个仅0.57MB的AI提示路由工具,自动将提示分发到成本最低且能处理的模型,可降低云AI成本96%并防止敏感信息泄露
Free plugin that finds where your code overpays for LLM APIs
免费插件,可自动识别代码中LLM API调用的高成本使用点,帮助开发者优化API开支
ParkMyAws – stop paying for dev/staging AWS instances at night
一个自动化工具,可自动关闭夜间未使用的 AWS 开发与预发布环境实例,帮助开发者节省云成本
Token Governor – The cheapest LLM token is the one you never send
通过智能预判和缓存策略,减少LLM调用次数,从而降低API成本,适合注重成本控制的AI应用开发者。
SaaSDiet
SaaSDiet 是一款隐私优先的 Chrome 扩展,帮助用户识别未充分利用的 SaaS 订阅,追踪使用记录并一键清理,解决企业与个人用户因订阅臃肿导致的浪费问题,适合注重成本控
Wei-Shaw/sub2api
Sub2API 是一个开源中转服务,可统一接入 Claude、OpenAI、Gemini、Grok 等多个大模型 API,支持拼车共享与成本分摊,让开发者无需更换账号即可高效使用多
Cost.dev (YC W21) – making agents cost-aware and cheaper to call
Cost.dev 是 YC 孵化项目,通过让 AI 代理具备成本意识,优化调用策略,显著降低大模型使用成本。
Oxlo.ai
Oxlo.ai 是一个 AI 模型调度与成本优化平台,允许开发者在多个 AI 模型间无缝切换,实现性能与成本的动态平衡,避免模型调用费用飙升。
CloudNap
自托管的 AWS EC2 与 RDS 休眠调度工具,自动管理云资源启停,显著降低云服务成本。
Free plugin that finds where your code overpays for LLM APIs
一款免费插件,可自动分析代码中对大语言模型 API 的调用,识别高成本或冗余请求,帮助开发者优化成本,适合使用 LLM 的全栈与 AI 工程师。
Foreman, a self-hosted LLM gateway for cost aware model routing
Foreman 是一个自托管的 LLM 网关,可根据成本、延迟和质量自动路由请求到最优大模型,帮助团队在多模型环境中实现成本控制与性能平衡。
AI Model Cost Calculator
一款LLM API价格对比工具,可实时比较26种大模型API的调用成本,帮助开发者和企业优化AI支出,避免资源浪费。
I replaced Whisper with Parakeet TDT on a $55/month CPU server
Parakeet TDT 是一个轻量级语音识别模型,可在仅 55 美元/月的 CPU 服务器上替代 Whisper,显著降低部署成本。
ClearSpend AI
一款Fintech工具,通过AI分析软件使用情况,识别并停用未被使用的软件,帮助企业节省不必要的订阅开支。
SuperCompress
一个API服务,通过智能压缩技术降低LLM(大语言模型)的token使用量,最高可节省65%成本。
Frugon – Find which LLM calls a cheaper model could handle (local, MIT)
Frugon 是一个本地运行的工具,帮助开发者识别哪些大语言模型(LLM)调用其实可以用更便宜的轻量级模型替代,从而降低推理成本。
Token Governor – The cheapest LLM token is the one you never send
LLM令牌管理工具,通过智能拦截减少不必要的token发送,降低推理成本
SaaSDiet
Chrome 浏览器扩展,帮助 SaaS 用户追踪订阅使用情况、计算投入产出比,自动识别可砍的冗余支出
QuantumReckon – find your real cloud and AI spend, including tokens
一款云成本与 AI 消耗分析工具,精准追踪企业在 AWS/GCP/Azure 上的真实云支出与大模型调用成本(含 token 消耗),助力成本优化
ReasoningDensity
可视化AI API成本与Token消耗,无需提供API密钥即可分析模型使用情况,帮助优化AI支出。
Alternate Clouds
Alternate Clouds 是一个面向 AI 应用的低成本、易用的云基础设施平台,专为 AI 工作负载优化,提供简化部署与成本控制,适合 AI 开发者与初创团队。
50 Ultra-Cheap AI APIs
50个超低成本AI API集合,可将Claude/GPT等API成本降低最高96%
Corectic AI
Corectic AI 是一个AI服务聚合平台,帮助开发者和企业统一管理多个AI供应商,自动优化调用成本与性能,适合AI应用开发者和企业技术团队。
One API endpoint for multiple AI models to cut costs up to 30%
一个统一的AI模型API网关,支持接入多个大模型,帮助开发者和SaaS公司通过智能路由降低30%的AI调用成本
PXINK
通过图片提示替代文字输入,降低 Claude AI 模型的调用成本,适合开发者和 AI 工具使用者节省 Token 费用
LLMSlim v0.3.0
LLMSlim v0.3.0 是一个开源工具,通过离线提示压缩技术降低 LLM 的 token 消耗 40%-70%,显著节省成本。
Dynasight
Dynasight 是一款用于 Amazon DynamoDB 的错误预警工具,能提前发现高成本操作(如全表扫描),防止资源浪费和费用飙升,适合云架构师与后端工程师。
Echo – Fable-level results at 1/3 the cost using open-weight models
使用开源大模型实现媲美Fable的高质量生成效果,成本仅为原来的三分之一,适合AI应用开发者降低成本。