智能路由
provider=auto 时,Vyane 怎么自动把任务派给合适的模型
派任务时如果不指定 provider(用 --provider auto,也是默认),Vyane 会自动帮你选一个合适的执行目标。这一页讲它是怎么选的,以及为什么这么设计。
先说目标:为了解放注意力,不是省钱
大多数多模型工具做"智能路由",默认目标是省钱——便宜模型能答的就别用贵的。Vyane 明确不这么设。
它的路由目标是把你从"每次都要纠结派给谁"里解放出来。你专注在问题本身,系统按任务特征自动选合适的组合。省钱是顺带的结果,不是目的。
这个区别会实实在在影响行为:以省钱为目标的路由系统性偏向"够用就好",久了容易困在信息茧房;以解放注意力为目标,会更倾向并行、倾向让你用上更强或更新的模型。
一句话
路由的本质是对人的解放,不是对成本的优化。
怎么选:四个信号
auto 路由综合几路信号给每个候选打分,选最高的:
| 信号 | 看什么 |
|---|---|
| 任务标签 | 这是什么类型的活——写代码 / 审查 / 分析 / 规划……不同类型适合不同模型 |
| 复杂度 | 任务有多难(输入长度、预估推理步数),难的升档到强模型 |
| 预算状态 | 当前额度还剩多少,快见底时收敛到更省的组合 |
| 反馈闭环 | 你过去对这类任务的评分——某个模型在你这类问题上表现好,今后优先它 |
想看某个任务具体会怎么路由、每个候选拿了多少分,用 vyane check 的诊断模式:
uv run vyane check --diagnose "帮我重构这个鉴权模块"它会打印每个可用 provider 的四信号打分明细,让你看清"为什么系统会这么选"——路由不是黑盒。
按阶段动态分档
同一个大任务的不同阶段,该用的模型不一样。Vyane 的路由会随阶段动态调档:
- 规划阶段 —— 升档到强模型(想清楚方向最值钱)
- 执行阶段 —— 主力模型(大量产出,要稳)
- 调试 / 快速迭代 —— 快模型(小步快跑,反馈要快)
这样贵的推理花在刀刃上,而不是全程一个模型硬扛。
冷启动:没历史数据也能选
反馈信号要靠积累,那第一次用、还没有任何历史时怎么办?Vyane 不会退回瞎猜——它用相似任务的经验来兜底(找过往类似的任务看当时什么组合表现好),而不是从零硬套规则。数据越用越多,路由越准。
🚧 路由 v5 与融合策略在推进中
当前落地的是四信号路由(v4)。更进一步的级联(先用低成本模型快速筛、再用高成本模型精准验)和融合(多模型投票,判断共识 / 矛盾 / 缺口)属于设计方向,仍在推进,见规划。
什么时候不用 auto
auto 适合"我不想操心派给谁"。但你随时可以手动接管:
- 明确知道该用谁 —— 直接
--provider codex(或别的)。 - 想要固定一套组合 —— 用 profile,
--profile deep一句带出整套 provider/model 配置。 - 想多家并排比 —— 用 broadcast,不是路由选一个,而是都发一遍。