AI PRD / SDD 工具深度调研
工具调研 · organize 总索引 · AI 总索引
调研主题
AI 开发前的”前置统一整理需求”工具深度调研——涵盖 AI PRD 工具、规格驱动开发(SDD)工具、AI Agent 需求工程工具,重点比较中外市场差异,并形成选型决策依据。
文件清单
2026-07-14-AI-PRD-工具深度调研/
├── index.md # 本入口
├── report.md # ⭐ 主报告(8 章 + 附录 A:Spec Kit 实战手册)
├── outline.yaml # 5 个 search angle 的 query 与 rationale
├── fields.yaml # 字段定义(产品/市场/claim)
└── results/ # 证据 + 验证
├── angle_1_china.md # 中国产品全景
├── angle_2_overseas.md # 海外 AI PRD 商业化
├── angle_3_sdd.md # SDD 工具矩阵
├── angle_4_gartner_refutation.md # ⚠️ Gartner 42% 误引反证
├── angle_5_market_quant.md # 中外市场量化
└── verify_3vote.md # 3-vote verify 结果(Spec Kit / Kiro / ChatPRD)
5 大核心结论(TL;DR)
- 🟢 GitHub Spec Kit 是 SDD 赛道绝对头部开源——121k stars / 1,400 commits / 189 releases / v0.12.13(2026-07-13)/ MIT / 兼容 30+ AI agent(3-vote verify 通过)
- 🟡 AWS Kiro 是商业化 SDD IDE 首选,但有 3 个公开缺陷——Remote SSH/WSL 失效、生成速度慢、plan reversion bug;3-vote verify 发现新档位 Pro Max $100/月(报告已修正)
- 🔴 Gartner “42% AI 项目失败源于需求不清” 是误引——真实 Gartner 数字是 40%(2025-06 agentic AI)和 30%(2024 GenAI)。应回写修正 bilingual-research 上一轮报告
- 📊 中国 AI 编程工具市场 CAGR 40% 远超全球 17.1%——但被本土化 + 信创 + 数据安全法强力驱动,选型逻辑与海外完全不同
- ⚠️ baoyu-design 不是 PRD/SDD 工具——上一轮错误归类,本次修正(真实定位是 UI 设计交付工具)
深度补充(2026-07-14 第二轮)
- 附录 A: GitHub Spec Kit 实战手册——7 核心命令 / 3 可选命令 / 8 步流水线 / 4 层模板优先级 / 30+ AI agent 集成方式 / Spec Kit vs Kiro 决策对照
- 3-vote verify 章节——对 3 个最关键 claim 做交叉验证,修正 AWS Kiro 5 处遗漏(Pro Max 档、Free 永久免费、创业公司 1 年免费、$0.04/credit 单价、模型范围扩大)
阅读路径建议
| 你的需求 | 推荐阅读 |
|---|---|
| 5 分钟了解全景 | 报告摘要 |
| 选型决策 | 选型决策矩阵 |
| 评估 AWS Kiro | SDD 工具章节 |
| 引用 Gartner 数据 | ⚠️ 先读 angle_4 反证 |
| 修正上一轮报告 | 报告第 3 章反证 |
| 中外市场对比 | 报告第 4 章 |
| 看原始证据 | angle_1 ~ angle_5 |
上一轮对照
- bilingual-research(2026-07-14,8 轮双语覆盖):上一轮报告
- 本轮定位:深度决策依据,补齐所有盲区
- 详细差异:report.md §1.3
未覆盖盲区与下一轮建议
详见 report.md §6.5:
- PMAI 商业真实性专项验证
- OpenSpec 活跃度专项验证
- 全球 AI 编程市场数据反向溯源
- 3-vote adversarial verify 重跑(本轮因 RPM 限制跳过)
- EU AI Act 对 SDD 工具的影响专项
工作流元信息
| 字段 | 值 |
|---|---|
| 调研方法 | deep-research workflow(Scope → Search → Fetch → Verify → Synthesize) |
| Workflow Run ID | wf_c37ecd55-bcf |
| Workflow 完成度 | 22/24 agent(因 MiniMax 200 RPM 限制预防性停止) |
| 数据采集 | 30 URL / 68 claims / 32 central |
| 关键反证 | Gartner “42%” → 实际为 40% / 30% |
| 工具版本 | MiniMax-M3(充值用户 200 RPM) |
| 报告语言策略 | 中文为主,英文验证(双语覆盖) |