三层模型路由:便宜默认 + 强模型升级 + 本地兜底
想解决:在质量可接受前提下压低月账单
用了什么:DeepSeek + Claude + 本地模型
大概花费:个人项目可压到原账单 30–50%
适合:Agent、客服草稿、代码辅助
容易翻车:全丢给最强模型;没有日志就无法优化
步骤
- 默认层:DeepSeek / 国内高性价比模型处理 80% 请求
- 升级层:代码审查、架构决策、长文档推理走 Claude / GPT
- 兜底层:离线或密钥挂了时用本地小模型保证可响应
触发升级的启发式
- 用户明确说「架构 / 安全 / 重构」
- 默认层自我报告不确定
- 输出两次校验不一致
成本记录
用一张简单表:model, tokens_in, tokens_out, usd, task。每周看一眼,比玄学省钱有效。