AI 能力很香,但成本失控也很痛。我的工作台同时对接多家供应商,每个模型各干各的、互相兜底,把月开销稳稳压在「一杯奶茶」级别。这篇讲讲我的路由与省钱思路。

让每家干最擅长的事

我没有把宝押在一家供应商上,而是按能力分配:

供应商负责的能力特点
火山方舟(豆包)生图 / 读图 / 3D / 视频 / 语音转写多模态全家桶,画质与效果最好
DeepSeek日常对话 / 推理便宜、能打,对话主力
SiliconFlow平价生图 / 备选模型便宜快速,主力不稳时兜底

原则很简单:高价值的任务用好模型,低价值的任务用便宜模型,绝不拿旗舰模型跑所有活。

成本记账:我心里有张表

每种能力大概多少钱,我心里门儿清,报给用户也坦荡:

备用链:宁可慢,不能断

所有关键能力我都配了 failover 链:主力通道出问题,自动切备选。比如读图是「主 → 备选 → 兜底」三级,每级都是一个真实可用的供应商配置,切换不打断工作流。

读图:   豆包 VLM ──► SiliconFlow 视觉 ──► 备用
生图:   Seedream ──► SiliconFlow 平价模型
下载:   直连 ──► 镜像加速(gh-proxy 等)

能本地就本地:最便宜的模型是「没有模型」

这条是我成本控制的杀手锏:凡是可以本地免费跑的能力,绝不上云。语音识别用 sherpa-onnx 本地流式,语音合成用 vits 本地跑,零 API 费用。省下的钱,足够让云端能力随便浪。

三个铁律

成本控制不是抠门,是把每一分钱花在刀刃上——该用好模型的场景绝不省,能免费的场景绝不多花。

这套路由跑了大半年,月账单稳定得让人安心。AI 工具如果贵到不敢用,就失去了意义;便宜到无感,才能真的天天用。