自动混合选择
概览
automix 是实验性选择器,按配置的质量与成本,以及内部验证和升级估计,对候选模型排序。它返回一个模型;它不是串行的 confidence Looper。
该选择器受 Automatically Mixing Language Models 启发,但公开配置有意比研究系统更小。
主要优势
- 在配置的质量元数据与配置成本之间做平衡。
- 将候选集限制在匹配决策之内。
- 将实验性价值计算与路由资格分开。
解决什么问题?
总是选最强模型会浪费预算,总是选最便宜的模型又可能损害质量。AutoMix 根据配置元数据和内部估计,为有界候选集计算成本-质量值。
何时使用
在候选定价和质量元数据可用时,用 AutoMix 做实验。需要已支持、无状态且更易运维推理的策略时,优先使用 static、router_dc 或 multi_factor。
配置
algorithm:
type: automix
automix:
verification_threshold: 0.78
max_escalations: 2
cost_aware_routing: true
cost_quality_tradeoff: 0.3
discount_factor: 0.95
use_logprob_verification: true
只有上面这些字段属于当前决策级 AutoMix 契约。max_escalations 和 use_logprob_verification 为兼容性而接受,但不影响 AutoMix 选择。
完整示例见:
config/fragments/algorithm/selection/automix.yaml。