GitHub HydraFusion:Copilot 里按任务路由多模型,省 36%–67%
不是新底座模型,是路由。按任务把请求分到不同模型,质量靠近 Opus 5,账单按实际用到的 token 计。
约 2026 年 9 月 4 日,GitHub Blog 介绍 HydraFusion:研究预览,经 Copilot CLI 的 /experimental 可用。它不训练新基础模型,只做多模型路由。计费按各模型实际消耗的 token、按该模型单价累加。
三种模式
- Single:一次选一个合适模型。
- Cascade:多步接力。
- Critique:带批评 / 复核路径。
官方离线评测(相对 Claude Opus 5)
- TerminalBench 2.1:质量 +4.9 个百分点,估算成本低约 67%。
- DeepSWE:质量 −1.5 个百分点,成本低约 36%。
- CheckpointBench:质量 −0.1,成本低约 65%。
数字来自 GitHub;TerminalBench 在 8 月 11–25 日有两轮因 harness 故障被剔除。现阶段更适合首轮单提示;多轮对话后续再加强。本月计划进 VS Code 与 Copilot 应用。
主要依据报道 GitHub ships HydraFusion。评测数字为 GitHub 披露。