AI 能力很香,但成本失控也很痛。我的工作台同时对接多家供应商,每个模型各干各的、互相兜底,把月开销稳稳压在「一杯奶茶」级别。这篇讲讲我的路由与省钱思路。
让每家干最擅长的事
我没有把宝押在一家供应商上,而是按能力分配:
| 供应商 | 负责的能力 | 特点 |
|---|---|---|
| 火山方舟(豆包) | 生图 / 读图 / 3D / 视频 / 语音转写 | 多模态全家桶,画质与效果最好 |
| DeepSeek | 日常对话 / 推理 | 便宜、能打,对话主力 |
| SiliconFlow | 平价生图 / 备选模型 | 便宜快速,主力不稳时兜底 |
原则很简单:高价值的任务用好模型,低价值的任务用便宜模型,绝不拿旗舰模型跑所有活。
成本记账:我心里有张表
每种能力大概多少钱,我心里门儿清,报给用户也坦荡:
- 文生图:一张 1024×1024 约几毛钱(按 token 计),新用户还有免费额度。
- 3D 建模:一个模型约一两块钱,异步任务 6~15 分钟。
- 文生视频:按秒计费,720P 约 1.5 元/秒——最贵的一项,必须提前报价。
- 对话:按 token 计费,性价比最高,日常主力。
备用链:宁可慢,不能断
所有关键能力我都配了 failover 链:主力通道出问题,自动切备选。比如读图是「主 → 备选 → 兜底」三级,每级都是一个真实可用的供应商配置,切换不打断工作流。
读图: 豆包 VLM ──► SiliconFlow 视觉 ──► 备用
生图: Seedream ──► SiliconFlow 平价模型
下载: 直连 ──► 镜像加速(gh-proxy 等)
能本地就本地:最便宜的模型是「没有模型」
这条是我成本控制的杀手锏:凡是可以本地免费跑的能力,绝不上云。语音识别用 sherpa-onnx 本地流式,语音合成用 vits 本地跑,零 API 费用。省下的钱,足够让云端能力随便浪。
三个铁律
- 贵的先报价:按秒/按次的大额操作,执行前必须亮价格、等确认。
- 预算意识常驻:每次调用前心里有数,这笔操作大概多少钱、值不值。
- 别迷信「最贵=最好」:先试平价档,效果不够再升级,多数场景平价档完全够用。
成本控制不是抠门,是把每一分钱花在刀刃上——该用好模型的场景绝不省,能免费的场景绝不多花。
这套路由跑了大半年,月账单稳定得让人安心。AI 工具如果贵到不敢用,就失去了意义;便宜到无感,才能真的天天用。