GitHub Copilot开启多模型组队:HydraFusion成本最高降67%
发布时间:2026-09-05
动察 Beating AI 快讯,GitHub 给 Copilot 加了一个多模型编排系统 HydraFusion。它先判断任务该怎么做,再调用不同模型。目前有三种方式:简单任务交给一个模型直接完成;复杂任务先让成本更低的模型尝试,结果不过关再升级到更强模型;需要复核时,则让一个模型先做,另一个不同家族的模型专门挑错,再让第一个模型修改。GitHub 在三个编程 Agent 基准上拿它和 Claude Opus 5 对比。TerminalBench 2.1 高出 4.9 个百分点,DeepSWE 低 1.5 个百分点,CheckpointBench 只低 0.1 个百分点,基本持平;成本则分别降低 67%、36% 和 65%。这个思路很像 Sakana AI 的 Fugu。两者都是把「选哪个模型」进一步变成「怎么组织多个模型」。区别是 Fugu 本身就是一个训练出来的指挥模型,会学习怎么调用不同 Agent,甚至能递归调用自己;HydraFusion 目前仍然是在 Single、Cascade、Critique 三种固定执行模式里选择,更像把多模型调度直接塞进 Copilot。HydraFusion 已向所有 GitHub Copilot 套餐开放研究预览,目前需要在 Copilot CLI 的实验功能中开启。GitHub 也提醒,现阶段最适合一次说清楚的单轮编程任务,多轮长任务还在继续优化。----------缘辉旺盾网量化工具温馨提示:数字货币投资有风险,入市需谨慎;本文章不作为投资依据,仅供参考----------交流群:https://t.me/dunwangyuanhuiwang

动察 Beating AI 快讯,GitHub 给 Copilot 加了一个多模型编排系统 HydraFusion。它先判断任务该怎么做,再调用不同模型。


目前有三种方式:简单任务交给一个模型直接完成;复杂任务先让成本更低的模型尝试,结果不过关再升级到更强模型;需要复核时,则让一个模型先做,另一个不同家族的模型专门挑错,再让第一个模型修改。


GitHub 在三个编程 Agent 基准上拿它和 Claude Opus 5 对比。TerminalBench 2.1 高出 4.9 个百分点,DeepSWE 低 1.5 个百分点,CheckpointBench 只低 0.1 个百分点,基本持平;成本则分别降低 67%、36% 和 65%。


这个思路很像 Sakana AI 的 Fugu。两者都是把「选哪个模型」进一步变成「怎么组织多个模型」。区别是 Fugu 本身就是一个训练出来的指挥模型,会学习怎么调用不同 Agent,甚至能递归调用自己;HydraFusion 目前仍然是在 Single、Cascade、Critique 三种固定执行模式里选择,更像把多模型调度直接塞进 Copilot。


HydraFusion 已向所有 GitHub Copilot 套餐开放研究预览,目前需要在 Copilot CLI 的实验功能中开启。GitHub 也提醒,现阶段最适合一次说清楚的单轮编程任务,多轮长任务还在继续优化。

----------缘辉旺盾网量化工具温馨提示:数字货币投资有风险,入市需谨慎;本文章不作为投资依据,仅供参考 ----------交流群:https://t.me/dunwangyuanhuiwang