┌────────────────────────────────────────────────────────────┐
│ 1️⃣ 评估 Query 复杂度 │
│ simple < 30 字 / 无代码 / 无 FC → DeepSeek (¥0.014) │
│ medium 30-200 字 / 普通对话 → GLM (¥0.50) │
│ complex > 200 字 / 含代码 / FC → Qwen-Max (¥2.0) │
│ │
│ 2️⃣ 检查可用 Provider │
│ 扫描 8 个 *_API_KEY 环境变量 │
│ │
│ 3️⃣ 路由决策(4 种策略) │
│ ① cost_optimal — 最便宜可用(默认,适合大流量) │
│ ② balanced — 简单选便宜,复杂选强(平衡) │
│ ③ quality_first— 永远选质量最高(适合 VIP / 关键场景) │
│ ④ fastest — 简单模型 = 响应快 │
│ │
│ 4️⃣ Fallback 链 │
│ 首选失败 → 同档次次选 → 兜底(DeepSeek 或第一可用) │
│ │
│ 5️⃣ 记日志 │
│ query_text / complexity / selected / tokens │
│ cost_cny / cost_saved_cny / latency_ms / is_fallback │
└────────────────────────────────────────────────────────────┘
📌 模型档位:
| 档位 | 模型 | 单价 (¥/1K tok) | 质量 | 适用 |
| cheap | DeepSeek V4 | 0.014/0.028 | ★★★★☆ | 简单问候 / FAQ |
| cheap | 豆包 Seed 2.0 | 0.08/0.2 | ★★★☆☆ | 同上,备份 |
| balanced | 智谱 GLM-5.1 | 0.5/0.5 | ★★★★☆ | 中等对话 |
| balanced | MiniMax M2.5 | 0.5/0.5 | ★★★☆☆ | 中等 |
| premium | 通义 Qwen-Max | 2.0/6.0 | ★★★★★ | 复杂分析 |
| premium | Kimi K2.5 | 1.2/1.2 | ★★★★☆ | 长文 / 32k |
💰 节省估算:
假设月 10 万次 query,平均 200 tokens,如全用 Qwen-Max(¥2/1K) = ¥40,000
智能路由后:60% simple + 30% medium + 10% complex = ¥0.014×60% + ¥0.5×30% + ¥2×10% ≈ ¥0.36/1K
实际成本约 ¥7,200,节省 82%(¥32,800/月)