[开源] agy-staff: 让 Gemini 成为 Codex / Claude Code 的员工
pkuwkl:
Repo: [https://github.com/keli-wen/agy-staff](https://github.com/keli-wen/agy-staff)

其实这是把 Antigravity 做成了 Codex / Claude 的一个 subagent 插件 `agy-staff`,让 Gemini 为另外的模型“打工”。

为什么想做这个东西?主要是我在 agentic engineering 里遇到的一些痛点:
1. 目前速度快的模型通常效果不佳;而能力更强的模型推理速度往往比较慢(点名 GPT 5.6 Sol),额度也不够用。
2. Gemini 会员的获取成本较低,但怎样高效利用它的额度呢?现在它还不适合当 orchestrator。
从 Gemini 3.5 Flash 开始,其实 Gemini Flash 就有潜在的生态位——高效执行者。但那时它能力还太弱,用户(包括我)没法信任它。随着迭代到 Gemini 3.7 Flash,它的能力相比之前有了明显跃升,也靠谱了不少。所以我让 Codex 或 Claude Code 里的顶级模型通过 grill 和 review 得到解决问题的方案和见解,然后派 Gemini 充当他们的员工,完成具体工作。这个流程似乎能很好解决我上面提到的两个痛点。
而且 Antigravity CLI 还能原生调用 Nano Banana 结合 Gemini 系列模型的多模态/前端能力,面对不那么讲求执行力的领域(像营销、分析、设计),它也能成为 Codex / Claude 的强力助手(尤其 Claude 原生不支持生图)。

我做了对应的插件,目前支持五种常用角色:
- `staffer`:通用任务,也能调用 Antigravity 的原生能力生成图片
- `researcher`:代码库调研 / 深度研究
- `reviewer`:代码审查,也可以审方案、设计和决策
- `implementer`:实现边界明确的编码任务
- `ask`:快速提问,获取独立第二意见
这个插件主要围绕我自己的常见需求设计,比如代码实现、深度调研和独立审查(包括通用审查和代码审查)。为了让它更像 native 提供的 Subagent,我在编排流程上也迭代了几个版本,比如任务派发和唤醒、后台执行、结果回收和后续互动细节。
有些设计参考了 Anthropic 博客的最佳实践,但现在还处于早期阶段,很多判断还是基于我个人用的习惯和写博客时学的内容。
接下来我准备先用一两周,看看 Gemini 当员工能不能高效且高质量地完成任务。积累一些真实体验后,我会回来分享有意思的心得。
欢迎大家提 issue 和贡献代码!!
---
原文链接:[点击查看](https://www.v2ex.com/t/1235732)
Repo: [https://github.com/keli-wen/agy-staff](https://github.com/keli-wen/agy-staff)

其实这是把 Antigravity 做成了 Codex / Claude 的一个 subagent 插件 `agy-staff`,让 Gemini 为另外的模型“打工”。

为什么想做这个东西?主要是我在 agentic engineering 里遇到的一些痛点:
1. 目前速度快的模型通常效果不佳;而能力更强的模型推理速度往往比较慢(点名 GPT 5.6 Sol),额度也不够用。
2. Gemini 会员的获取成本较低,但怎样高效利用它的额度呢?现在它还不适合当 orchestrator。
从 Gemini 3.5 Flash 开始,其实 Gemini Flash 就有潜在的生态位——高效执行者。但那时它能力还太弱,用户(包括我)没法信任它。随着迭代到 Gemini 3.7 Flash,它的能力相比之前有了明显跃升,也靠谱了不少。所以我让 Codex 或 Claude Code 里的顶级模型通过 grill 和 review 得到解决问题的方案和见解,然后派 Gemini 充当他们的员工,完成具体工作。这个流程似乎能很好解决我上面提到的两个痛点。
而且 Antigravity CLI 还能原生调用 Nano Banana 结合 Gemini 系列模型的多模态/前端能力,面对不那么讲求执行力的领域(像营销、分析、设计),它也能成为 Codex / Claude 的强力助手(尤其 Claude 原生不支持生图)。

我做了对应的插件,目前支持五种常用角色:
- `staffer`:通用任务,也能调用 Antigravity 的原生能力生成图片
- `researcher`:代码库调研 / 深度研究
- `reviewer`:代码审查,也可以审方案、设计和决策
- `implementer`:实现边界明确的编码任务
- `ask`:快速提问,获取独立第二意见
这个插件主要围绕我自己的常见需求设计,比如代码实现、深度调研和独立审查(包括通用审查和代码审查)。为了让它更像 native 提供的 Subagent,我在编排流程上也迭代了几个版本,比如任务派发和唤醒、后台执行、结果回收和后续互动细节。
有些设计参考了 Anthropic 博客的最佳实践,但现在还处于早期阶段,很多判断还是基于我个人用的习惯和写博客时学的内容。
接下来我准备先用一两周,看看 Gemini 当员工能不能高效且高质量地完成任务。积累一些真实体验后,我会回来分享有意思的心得。
欢迎大家提 issue 和贡献代码!!
---
原文链接:[点击查看](https://www.v2ex.com/t/1235732)
评论
暂无评论。