不知道该买 Claude Code、Cursor、Codex 还是 Trae?这套工程包让你用同一个项目、同一份需求、同一套验收测试,在自己的电脑上跑出属于你自己的横评结果。

一、核心功能
- 统一需求 + 自动打分:9 个功能点的短链服务需求文档,配 46 条 HTTP 验收测试和一键打分脚本(自动启动、测试、重启、复测持久化),任何工具写出的实现都能用同一把尺子量。
- 四套规则文件 + 7 轮提示词剧本:CLAUDE.md、.cursor/rules、AGENTS.md、.trae/rules 正文逐字相同;7 轮任务提示词四个工具逐字相同,只有“操作方式”分别写明。
- 真实的 Claude Code 运行记录:2026-10-01 用 Claude Code 无界面模式零干预跑完 7 轮,每轮提示词、工具调用、最终回复原文、最终代码(471 个单元测试)和验收结果(46/46)全部保留。
- 全部提示词记录 + 计分表:40 条提示词(4 工具 × 7 轮 + 12 条救火提示词)整理成可筛选、可收藏的 Excel;计分表用公式自动汇总通过率、耗时、追加提示、违规次数并加权打分。
- 和免费资料相比:免费《选型一页纸》告诉你哪个场景先试哪个工具;付费包给你亲手验证的全套工具,以后也能用来评估任何新出的编程工具。
二、适合人群
- 个人开发者:准备在几款工具之间选一个长期付费,用一个下午做完对照。
- 技术团队负责人:规则文件模板可直接改成团队的 AGENTS.md,验收测试思路可用于评估 AI 产出。
- AI 编程讲师、创作者:现成的对照实验素材和可复现流程。
- 不适合:只想听一句“哪个最好”的读者;没有 Python 环境也不打算安装的读者;希望包里已有 Cursor / Codex / Trae 实测成绩的读者——这三组需要你自己跑。
三、购买后获得什么
| 文件 / 目录 | 内容 | 数量 / 规模 |
|---|---|---|
| 01-spec/PRD.md | 统一需求文档 | 9 个功能点、11 个错误码 |
| 02-acceptance-tests/ | 验收测试与一键打分脚本 | 46 条用例 |
| 03-reference-impl/ | Python 标准库参考实现 + Docker | 服务端约 410 行,24 个单元测试 |
| 04-tool-claude-code/ | 规则文件、提示词剧本、真实运行记录 | 7 轮日志、最终代码 471 个单元测试 |
| 05~07 Cursor / Codex / Trae | 规则文件与提示词剧本(Codex 另附批量脚本) | 每个工具 7 轮 |
| 08-prompt-log/ | 提示词库 Excel、救火提示词、记录模板 | 40 条 + 12 条 + 1 份 |
| 09-scorecard/ | 对照计分表(公式自动加权) | 4 个工作表、7 个评分维度 |
整个 ZIP 共 92 个文件,文件名全部为英文,Windows / macOS / Linux 均可使用。配套教程:AI 编程工具横评:Claude Code / Cursor / Codex / Trae。
四、售后边界与免责声明
- 本资料用于学习、研究、项目搭建和合法商业应用。
- Claude Code 一组为本站真实运行记录(单次运行,受模型版本与随机性影响);Cursor、Codex、Trae 三组为可执行剧本,本站尚未实跑,包内不含它们的成绩。
- 不包含第三方平台账号、API 额度、服务器、付费模型订阅等第三方费用。
- 第三方平台、模型、接口、价格与政策可能随时调整,不保证所有第三方服务永久可用;工具的模式名称与命令参数以当前版本为准。
- 使用者需自行遵守所在地法律法规、第三方平台条款、隐私政策与数据合规要求;不支持违法违规、绕过平台限制、滥用接口等用途。
- 数字资料一经下载,退换规则按 AI Stack Nav 网站政策执行;仅限购买者个人或本团队内部使用,请勿转售或公开传播。