GitHub Copilot CLI 新增跨模型审查功能,提升代码审查效率

微软 GitHub 推出实验性功能 Rubber Duck,利用 Claude Sonnet 4.6 和 GPT-5.4 模型组合,有效提升代码审查性能,弥补性能差距达 74.7%。

13效率工具代码审查AI工具GitHub性能提升

功能介绍

微软 GitHub 官方宣布,为 Copilot CLI 引入跨模型 AI 审查功能 Rubber Duck,旨在提升代码审查效率。

该功能通过引入异构模型作为独立审查者,提供差异化视角,挖掘潜在错误,帮助开发者避免代码规划阶段的早期决策错误。

模型组合与性能提升

用户可选择 Claude 系列模型作为主控,Rubber Duck 将调用 GPT-5.4 进行审查。通过 SWE-Bench Pro 基准测试,Sonnet 4.6 搭配 Rubber Duck 后,成功弥补了 74.7% 的性能差距。

微软 GitHub 推出跨模型 AI 审查:Claude Sonnet 4.6 搭配 GPT-5.4,弥补 74.7% 性能差距插图

审查模式与实际应用

Rubber Duck 支持主动、被动及用户触发三种模式,确保过程透明。实际案例显示,它能有效挖掘深层问题,如架构逻辑漏洞、循环覆盖错误及跨文件冲突等。

使用方法

用户需安装 GitHub Copilot CLI 并运行 /experimental 命令启用该功能。选择 Claude 模型并开通 GPT-5.4 访问权限即可体验。