GitHub Copilot CLI 上线 HydraFusion:一次请求会被拆成起草、升级或交叉审查

HydraFusion 研究预览进入 Copilot CLI /experimental:按任务在 Single、Cascade、Critique 间路由。按底层模型标准费率计费,官方建议先用于第一轮单提示编码任务。

用 Apifox,节省研发团队的每一分钟

GitHub Copilot CLI 上线 HydraFusion:一次请求会被拆成起草、升级或交叉审查

免费使用 Apifox

相关推荐

最新文章

API

一体化协作平台

API 设计

API 文档

API 调试

自动化测试

API Mock

API Hub

立即体验 Apifox
目录

GitHub 在 2026 年 9 月 4 日的官方博客宣布 Project HydraFusion:这是 GitHub Copilot 的研究预览,用运行时编排在多家模型之间做语义路由,而不是让用户每次锁死一个模型。9 月 10 日的 Copilot weekly changelog(覆盖 9 月 7 日那一周)写明:HydraFusion 已进入 Copilot CLI 的 /experimental。你像选普通模型一样选它,系统再为当前任务在 local、cloud 和 compound 模型之间平衡性能、成本和延迟。

GitHub Copilot 中 HydraFusion 研究预览的界面示意
官方配图:HydraFusion 作为可选模型出现在 Copilot 界面。来源:GitHub Blog《Project HydraFusion》,2026-09-04。

平台团队原先的摩擦很具体:同一个 CLI 会话里,简单补丁用旗舰模型太贵,复杂排查用便宜模型又经常返工。Auto 选择只解决“挑一个模型”,解决不了“这一轮要不要起草、升级、还是交叉审查”。本文要回答:HydraFusion 三种编排分别改了哪一步、token 怎么计费、以及人必须在哪一步接管未完成草稿。

AI Coding 交流群

如果你也在用 AI 写代码,或者正在研究 Cursor、Claude Code 这些工具,欢迎加入以下交流群。群里平时会聊一些 AI 编程的实际用法、开发工作流,还有各种新工具和新玩法。

发生了什么

官方定义是:HydraFusion “delivers frontier intelligence through runtime orchestration”。它在运行时从多家供应商的模型里挑选,并生成执行计划,而不是把一次请求绑死在单一模型上。用户选择方式和其它 Copilot 模型相同,路由过程对用户隐藏。启用路径写在博客:Copilot CLI 里先 /update,再 /experimental on,然后在 /model 里选 HydraFusion (Research Preview)。反馈走 CLI 的 /feedback,或 GitHub Community discussion 206492。

可用性声明是:所有 GitHub Copilot 计划都可以通过 CLI 的 /experimental 使用。计费按 HydraFusion 实际调用模型的标准费率;起草、评论、改写、升级、重试、回退每一段都计入。changelog 补充:它做的是 local、cloud 和 compound 模型之间的 automated semantic routing。博客还写明,这是在更早 Auto 模型选择之上的下一步:Auto 只挑一个模型,HydraFusion 会为请求生成完整执行计划。

官方把路由写成一种优化:信号覆盖推理、代码生成、调试和工具调用。每一轮请求只会落入三种模式之一,不会同时跑完三种再让你挑。阶段信息可以看见,但中间草稿默认不展示,目的是避免把未完成工作当成已完成。

完整工作场景:一次 CLI 任务怎么被拆开

输入仍是你在 Copilot CLI 里的一条编码提示,例如“把失败的集成测试修到绿、不要改公共 API”。操作从“选定 Claude 或 GPT 某一个”变成“选定 HydraFusion”。系统根据上述信号,把这一轮落到三种模式之一。Single:一个被选中的模型直接完成任务,适合简单、低风险的第一轮请求。Cascade:便宜模型先起草,质量门决定接受还是升级到更强模型。Critique:写作者出草稿,另一模型家族、且不带工具的评论者做审查(官方比作 Rubber Duck),写作者再改一版。

HydraFusion 的 Single、Cascade、Critique 三种编排对照
编辑绘制:三种编排各自改变的步骤与计费含义。依据 GitHub Blog 2026-09-04。

交付看起来仍是一条最终结果。反馈循环因此变了:你不再在半成品 diff 上做决定,而是对编排后的终稿做验收。官方建议今天最好从 first-turn、single-prompt 的编码任务开始;更长的多轮会话是后续范围,不是当前承诺。取消或校验失败时,系统不会打补丁;每一段编排都有超时和取消。这意味着:如果你在 Cascade 升级途中打断,仓库里不应出现半截补丁,但账单上已经发生的 token 仍会留下。

一个可核对的验收动作是:同一条提示先用固定旗舰模型跑一遍,再用 HydraFusion 跑一遍,对比最终 diff、测试是否通过、以及 CLI 用量里实际落到了哪些底层模型。不要只看“选了 HydraFusion”这一次点击。

为什么这会改变工作流

因果很直接。以前成本治理只能靠“禁用某模型”或“提醒大家别用最贵的那一档”。现在编排本身就是成本策略:简单任务走 Single,可升级任务走 Cascade,需要交叉审查的走 Critique。博客给出的是产品方离线评测,必须按产品自述标注:在 TerminalBench 2.1 上相对 Claude Opus 5(中等推理、相同工具与限制)验证任务质量高 4.9 个百分点,估计成本低 67%;DeepSWE 质量低 1.5 个百分点、成本低 36%;内部 CheckpointBench 质量低 0.1 个百分点、成本低 65%。同一组评测也把 GPT-5.6 Sol 列为基线之一。

官方同时写了限制句:这些受控离线结果绑定评测版本、配置、模型池和定价,预览阶段会拿真实工作负载继续测。结果、模型、工作流、可用性、名称和产品行为都可能变。因此不能把 4.9 个百分点写成你们仓库里已经发生的收益,只能写成 GitHub 在特定基准上的产品方数据。

限制与人接管点

研究预览意味着名字、行为和可用性都可以改。评论者被设计成隔离、无工具,不能替你跑测试或碰生产凭证。你在 PR 里看到的仍是终稿,人必须自己打开 diff、跑测试,不能把“编排过”当成“已验证”。计费上,Cascade 和 Critique 会比 Single 多消耗若干段 token,账单脚本如果只按“选了 HydraFusion 一次”估算,会严重偏低。

官方写明当前最合适的起点是第一轮、单提示编码任务。把跨小时的重构、多文件迁移或需要连续澄清需求的会话交给它,超出了当前文档承诺。VS Code 1.137 的 Automations、Copilot 应用的 Jira 画布、JetBrains 企业托管沙箱是同一周 changelog 的其它条目,不是本文事件。HydraFusion 也不替代组织级模型策略:管理员仍要决定哪些底层模型对业务可见,路由只能在已授权的池子里选。

如何试用

安装或更新 GitHub Copilot CLI,进入会话后执行 /update,打开 /experimental on,在 /model 选择 HydraFusion (Research Preview)。先拿一条可独立验证的第一轮任务(例如修一个失败测试、补一段确定接口的实现),记录它走了哪种编排、最终 diff 是否仍需人工改。用 /feedback 或 Community discussion 206492 回传真实失败案例。不要把生产事故排查的第一条提示直接交给预览路由。

信息来源

开发必备:API 全流程管理神器 Apifox

介绍完上文的内容,我想额外介绍一个对开发者同样重要的效率工具 —— Apifox。作为一个集 API 文档、调试、设计、测试、Mock、自动化测试于一体的工具,Apifox 是目前提升研发效率的首选。

如果你正在开发项目,不妨试试其极其友好的界面设计,它完全兼容 Postman 和 Swagger 数据格式,导入数据非常方便,,即使是新手也能很快上手,点击这里即可注册使用

Apifox

值得一提的是,除了个人和常规团队使用,针对有高安全合规要求、或需要在内网环境协作的企业,Apifox 还提供了深度定制的私有化部署方案

获取专属报价与部署方案

icon 详细的私有化部署系统架构与安全白皮书
icon 针对您公司规模的专属报价单
icon 免费的 1v1 专属产品演示 (Demo) 机会
获取部署方案
* 提交后,我们的客户经理将在 1 个工作日内与您联系
林俊锋 企业微信
@Apifox 专属顾问
扫码备注: 私有化 + 公司名