GreatCTO 实测:69 个 AI Agent 帮你从设计到上线,一个功能只要 $3.40

GreatCTO 实测:69 个 AI Agent 帮你从设计到上线,一个功能只要 $3.40

Solo 开发者最大的痛点不是写代码,而是一个人要干一个团队的活:架构设计、前后端开发、测试、安全审查、部署上线——每一步都需要不同领域的专业知识。现在,一个叫 GreatCTO 的开源工具声称:描述一个产品,批准两次,就能拿到一个完整可运行的应用。

它背后是 69 个专家 AI Agent,按软件开发生命周期(SDLC)编排成一条流水线。实测数据:一个功能从描述到上线 1 小时 26 分钟,token 成本 $3.40;完整产品中位数 $171。

它怎么工作?

GreatCTO 的流程极其简洁:

描述产品 → AI 生成 spec + 架构 + 数据模型 + 界面设计 → 🟢 你审批设计 → AI 脚手架 + 后端 + 前端 + 测试 + 代码审查 + 安全审计 → 🟢 你审批部署 → 上线

你全程只做两件事:批准”建什么”批准”上不上线”。中间 69 个 agent 自动协作。

日常使用三个命令:

  • /start "描述你的产品" — 启动流水线
  • /inbox — 查看待审批项和阻塞任务
  • /digest — 周报:DORA 指标 + 每个功能的成本

69 个 Agent 是怎么分工的?

GreatCTO 把 69 个 agent 按角色分成 7 个团队:

1. 产品定义团队(Prototyper)— 4 个 agent
把模糊的想法变成可执行的方案:

  • product-owner:第一个启动的 agent。把原始想法变成产品简报,甚至会启动”多 LLM 辩论”(4 个 AI 角色在 4 个模型上辩论)来验证方案
  • architect:生成架构文档、ADR(架构决策记录)、成本估算
  • decision-scorer:给 2+ 个架构方案打分,输出加权评分表
  • design-advisor:选设计系统、列组件清单、写文字版线框图

2. 开发团队(Builder)— 11 个 agent
各司其职的全栈开发:

  • app-scaffolder:搭建 Next.js + TypeScript + Tailwind 骨架,配好数据库和认证
  • senior-dev:主力开发,TDD 方式实现功能(可并行运行多个)
  • auth-engineer:认证和权限专家(Auth.js / Clerk / RBAC / 多租户隔离)
  • integrations-engineer:第三方 API 对接(Stripe / Twilio / Google Calendar / Shopify)
  • subscription-billing-engineer:订阅计费(Stripe Billing / 用量计费 / 试用期 / 退款)
  • mobile-app-builder:React Native 移动端开发
  • geo-routing-engineer:地理空间和路径优化
  • media-pipeline-engineer:视频/图片处理管线
  • connector-builder:数据源连接器(Stripe / GA / QuickBooks)
  • migration-import-engineer:数据迁移和导入
  • ai-eval-engineer:AI 产品的评估管线

3. 质量团队(Sweeper)— 3 个 agent
代码审查 + 测试:

  • qa-engineer:分析实际代码,按类型做 QA
  • code-reviewer:读 diff,报 bug,给裁决
  • e2e-test-engineer:生成 Playwright 端到端测试,部署后自动跑

4. 安全与合规团队(Reviewers & Safety)— 30+ 个 agent
这是 GreatCTO 的核心护城河。覆盖 30+ 个垂直行业的合规审查:

  • pci-reviewer:PCI-DSS 支付合规
  • healthcare-reviewer:HIPAA 医疗数据合规
  • gdpr-reviewer:GDPR + EU AI Act + NIS2
  • ai-security-reviewer:OWASP LLM Top 10
  • legal-reviewer:律师-客户特权 / UPL 防护
  • insurance-reviewer:NAIC 保险合规
  • tax-reviewer:IRS 电子报税
  • ……还有政府、教育、游戏、流媒体、固件、DAO 等 30+ 个领域

每个 reviewer 的工作方式相同:分析项目类型 → 输出威胁模型(TM-{slug}.md)→ 在 senior-dev 开发前签署关键/高危缓解措施。

5. 增长团队(Grower)— 2 个 agent

  • performance-engineer:性能测试(k6/Locust)、延迟分析、容量规划
  • growth-engineer:北极星指标、激活/留存漏斗、增长实验设计

6. 运维团队(Maintainer)— 3 个 agent

  • devops:部署执行
  • infra-provisioner:基础设施配置(Neon 数据库 / Vercel 托管 / DNS / TLS)
  • l3-support:线上问题排查和事故响应

7. 编排团队(Orchestration & Meta)— 4 个 agent

  • pm:读架构文档,分解任务,生成 Gantt 图,分配 agent
  • coordinator:多流协调,跨 agent 调度
  • project-auditor:技术债务审计和重构计划
  • continuous-learner:会话结束时提取模式和经验,写入全局知识库

实测数据

GreatCTO 在公开 benchmark 上跑了 7 个完整产品:

指标 数据
单功能端到端 1 小时 26 分钟 / $3.40 token 成本
完整产品(7 个基准) 中位数 $171 / 质量 70/100(58-86)
典型月度(20 次流水线) ~$34
支持的产品类型 60 种,覆盖 15 个美国行业

质量评分来自运行产品自身的测试(不是数文件数),所以是 70 而不是 100——这恰恰说明数据是真实的。

安全性设计

几个值得注意的设计:

  • 范围隔离:agent 在写入时就被限制在自己的职责范围内,不是审查时才检查
  • 合规永不跳过:即使设为”auto”模式(无人审批),安全和合规门控仍然强制执行
  • 本地运行:所有代码在本地执行,prompt 只发给你自己的 LLM 提供商
  • 遥测默认关闭:不收集任何使用数据

安装

npx great-cto init

一行命令。自动安装 Companion 插件(Superpowers、Beads)。重启 Claude Code 后即可使用。支持 Claude Code(默认)和 OpenAI Codex(加 --host codex)。

需要 Node ≥ 18.17。

适用场景与局限

最适合:独立开发者、Solo 创业者、CTO 一个人扛一个产品。你有一个想法,想快速验证——GreatCTO 帮你从 0 到上线。

不适合:多人协作的团队(”For one builder”是作者原话);需要 CI/CD 系统的成熟项目;需要正式合规认证的场景(PCI/HIPAA 脚手架是起点不是终点)。

对不同角色的意义

对独立开发者:你不再需要自己搞安全审查、写测试、配基础设施。69 个 agent 分工覆盖了你一个人顾不到的角落。$3.40 一个功能,$171 一个产品——这个成本结构改变了”一个人能做什么”的上限。

对创业团队:用 GreatCTO 快速出 MVP,验证产品假设,再决定是否组建正式团队。先跑通流程再招人。

对 AI 应用开发者:GreatCTO 的多 agent 编排架构(7 团队 69 agent + 范围隔离 + 合规门控)是一个值得研究的参考实现。它证明了”LLM + 多 agent 协作”不是 demo,而是已经跑通的工程实践。

关注 AI商业快讯,每天一篇 AI 热点深度解读。

GreatCTO 为开源项目(MIT 协议),本文不构成投资建议。
相关阅读:AI Skill 生态全景:从 1000+ 仓库精选 10 个必装技能LeanCTX 实测:砍掉 86% token 成本