摘要: 本文横向对比 2026 年最常用的四款 AI 编程工具——Claude Code、Cursor、Codex 和 Trae,覆盖产品形态、价格、规则文件、上手步骤与适用场景,并给出一套“同一个项目、同一份需求、同一套验收测试”的对照方法。结论先说:四款工具没有绝对的赢家,先按你写代码的位置(终端还是编辑器)和已有订阅选,再用自己的小项目跑一遍验收测试定夺。我们用 Claude Code 真实跑完了 7 轮对照流程(零人工干预,46 条验收用例全部通过),完整记录了它的耗时和行为;Cursor、Codex、Trae 本站尚未在同条件下实跑,文中对它们的判断均基于官方文档和编辑经验,并已明确标注。适合正在选型的个人开发者、技术团队负责人和想入门 AI 编程的创作者阅读。
核心结论
如果只能记住一句话:在终端里干活、需要跨多文件长链路改动,优先 Claude Code 或 Codex;习惯在编辑器里看 diff、逐块接受改动,优先 Cursor 或 Trae;已经付费订阅了 Claude 或 ChatGPT 的人,先用订阅里自带的那一款,不要重复付费。
- 形态决定体验:Claude Code 和 Codex 是“终端 Agent + 多端延伸”(IDE 插件、桌面、网页、云端任务),Cursor 和 Trae 是“AI 原生 IDE”。前者擅长把一件事从头做到尾,后者擅长让你边看边改。
- 入门价格都在 20 美元/月这一档:Claude Pro、Cursor Pro、ChatGPT Plus 均为 $20/月;Trae 个人档更低(第三方汇总为 Lite $3、Pro $10);Codex 在 ChatGPT Free 和 Go($8)中也有基础额度。重度使用都会走向 $100~$200/月的高档位或按量计费。
- 规则文件正在趋同:CLAUDE.md、.cursor/rules、AGENTS.md、.trae/rules 写法不同,但内容可以完全一样;AGENTS.md 已被 Codex、Cursor 等多个工具识别,Claude Code 也能读取。把项目规则写好,比纠结选哪个工具更能提升结果。
- 我们的实测样本:Claude Code(CLI 2.1.287,模型 claude-sonnet-5-5)按 7 轮固定提示词完成一个短链服务,用时约 21 分钟,验收 46/46,自写 471 个单元测试,过程中没有改动验收测试、没有引入第三方依赖;缺点是实现偏重,代码量约为参考实现的 2 倍。
- 选型建议:别看榜单,用同一个小项目把候选工具各跑一遍,按验收通过率、追加提示次数、违规次数和你的主观体验打分。本文第六节给出了完整做法。
背景与主要变化
结论:2026 年的 AI 编程工具已经从“补全”全面转向“Agent”,比较的重点不再是谁的补全更准,而是谁能在你的规则约束下,把一个多步骤任务稳定做完。
两年前讨论 AI 编程,大家比的是 Tab 补全的命中率;今天四款主流工具都具备了“读仓库—改多个文件—运行命令—看测试结果—再修改”的闭环能力。变化体现在三个方面。
第一是形态多端化。根据 Claude Code 官方文档,它可以在终端、VS Code / JetBrains 插件、桌面应用和浏览器中运行,并支持云端长任务、定时任务和 GitHub 代码审查。OpenAI 的 Codex 价格与套餐说明列出了桌面应用、CLI、IDE 插件、网页和移动端等使用入口。Cursor 的 官方价格页把 Cloud Agents、MCP、Skills、Hooks 都列为个人付费档的功能。Trae 则在 IDE 之外推出了 SOLO 模式,面向“一句话起项目”的场景。
第二是计费从“次数”走向“用量”。Cursor 官方文档说明个人档包含两个用量池(Cursor 自有模型与其他模型),超出后可按模型 API 价格继续使用或升级套餐;Codex 的 Plus 与 Business 档按模型复杂度共享用量额度;Claude Code 在 Pro、Max、Team 等订阅中按订阅额度使用,也可以改用 API Key 按量计费。这意味着“$20 能用多少”越来越取决于你用哪个模型、任务多长,官方普遍不承诺固定次数。
第三是项目规则标准化。过去每个工具都有自己的提示词设置入口,现在都支持把规则写进仓库里的文件、随 git 版本管理。AGENTS.md 官方网站把它定义为“写给编程 Agent 的 README”,并列出 Codex、Cursor、Jules、Gemini CLI 等支持方。这一变化对团队尤其重要:规则可以评审、可以复用,换工具时迁移成本很低。
需要注意的边界:这些产品迭代极快,模型名称和套餐几乎每月都在变。例如 Codex 官方模型页已提示旧模型将于 2026 年 10 月 14 日退役。本文所有价格与功能信息的核验日期为 2026 年 10 月 1 日,付款前请以官网为准。如果你想跟踪后续变化,可以在站内搜索 Claude Code 相关教程 和 Cursor 使用技巧。
核心功能拆解
结论:四款工具的核心能力高度重合,真正的差异在“交互形态、规则文件、可脚本化程度和价格结构”这四点上。
下面这张表汇总了个人用户最关心的维度(价格为美元标价、按月计,以官网为准):
| 对比项 | Claude Code | Cursor | Codex | Trae |
|---|---|---|---|---|
| 产品形态 | 终端 Agent,延伸到 IDE 插件、桌面、网页 | 独立 AI IDE(VS Code 系) | CLI、IDE 插件、桌面、网页与云端任务 | 独立 AI IDE,含 SOLO 模式 |
| 免费可用 | 否,需 Pro 起 | Hobby 档有限额度 | ChatGPT Free 含基础额度 | Free 档有限额度 |
| 个人起步付费 | Pro $20(年付 $17) | Pro $20 | Go $8 / Plus $20 | Lite $3 / Pro $10(第三方汇总) |
| 高档位 | Max 起 $100 | Pro Plus $60、Ultra $200 | Pro 起 $100($100/$200/$500 三档) | Pro+ $30、Ultra $100(第三方汇总) |
| 团队版 | Team $25/席(年付 $20) | Teams $40/人,Premium $120/人 | Business $20/人 | 企业版经 BytePlus 洽谈 |
| 项目规则文件 | CLAUDE.md(也可读取 AGENTS.md) | .cursor/rules/*.mdc(也支持 AGENTS.md) | AGENTS.md | .trae/rules/*.md |
| 无界面运行 | claude -p | 提供 CLI,以官方文档为准 | codex exec | 以 IDE 交互为主 |
| 开源情况 | 闭源 | 闭源 | CLI 以 Apache-2.0 开源 | 闭源 |

Claude Code:终端里的“全流程执行者”
Claude Code 的核心是一个能读写文件、运行命令、调用 MCP 工具的 Agent。它在每次会话开始时读取项目根目录的 CLAUDE.md,官方文档说明如果仓库里已有 AGENTS.md,它也可以读取。它的强项是可脚本化:claude -p "<提示词>" 可以无界面运行,配合 --continue 续接会话,能直接嵌入 CI 或批处理脚本。我们的对照实验就是这样跑的。另外它支持子 Agent 并行、Hooks(在动作前后执行命令)和 Skills(封装可复用流程)。
Cursor:编辑器里的“看得见的改动”
Cursor 的优势在于所有改动都以 diff 形式出现在编辑器里,你可以逐块接受或拒绝。项目规则放在 .cursor/rules 目录下的 .mdc 文件中,通过 frontmatter 里的 alwaysApply、description、globs 控制规则何时生效,官方列出了“始终应用、智能判断、按文件匹配、手动 @ 引用”四种模式。个人付费档还包含 Cloud Agents 和按量计费的 Bugbot 代码审查。
Codex:订阅里自带的多端 Agent
Codex 最大的现实优势是“很可能你已经买了”:官方说明 ChatGPT 的 Free、Go、Plus、Pro、Business、Edu、Enterprise 都包含 Codex。CLI 在 GitHub 以 Apache-2.0 协议开源,登录时选择 Sign in with ChatGPT 即可使用订阅额度,也可以改用 API Key 按量计费。它通过根目录的 AGENTS.md 获取项目规则,codex exec 适合批量与自动化,/review 可做代码审查。
Trae:中文友好、门槛最低
Trae 是字节跳动推出的 AI IDE,有国际版(trae.ai)和国内版(trae.cn),两者可用的模型不同。社区工具 rulesync 整理的文档显示,项目规则放在 .trae/rules/ 目录、MCP 配置在 .trae/mcp.json,并支持嵌套的 AGENTS.md。它的价格在四者中最低,SOLO 模式适合“一句话生成一个可运行项目”。需要提醒的是,Trae 官方价格页在本次核验时无法直接抓取,表中 Trae 价格来自 2026 年 6 月的第三方汇总,请以官网显示为准。
适用人群与使用场景
结论:按“你在哪里写代码”和“你已经为什么付费”两个问题,就能排除掉一半选项。
我们把常见场景整理成下表(首选 / 备选为编辑判断,结合官方功能与价格页得出,不代表官方结论):
| 场景 | 首选 | 备选 | 理由 |
|---|---|---|---|
| 零基础,想做第一个小网页/小工具 | Trae | Cursor | 有免费档、中文界面,Builder / SOLO 可一句话起项目 |
| 习惯 VS Code,天天写业务代码 | Cursor | Trae | 补全 + Agent 都在编辑器里,看 diff、逐块接受最顺手 |
| 终端重度,跨多文件重构、大改动 | Claude Code | Codex | 终端原生,读写文件和跑命令一体,适合长链路任务 |
| 已订阅 ChatGPT,想顺手用上 | Codex | Claude Code | ChatGPT 套餐已含 Codex,CLI / IDE 插件 / 云端通用 |
| CI 里自动修复、批量脚本化 | Claude Code | Codex | claude -p 与 codex exec 都能无界面运行 |
| 预算最低,按月几美元起步 | Trae | Codex | Trae Lite $3/月;Codex 在 ChatGPT Free/Go 中有基础额度 |
几类典型用户的具体建议:
- 独立开发者 / 自由职业者:一个主力工具加一个备用即可。比如主力 Cursor 处理日常编码,遇到大规模重构时用 Claude Code 或 Codex 在终端里一次做完。
- 技术团队负责人:先统一规则文件,再谈工具。把团队规范写进 AGENTS.md(或对应格式),让不同成员即使用不同工具也遵守同一套约束。采购时优先考虑团队已有的账号体系(Claude Team、ChatGPT Business 或 Cursor Teams)。
- 自媒体创作者、产品经理:目标是快速做出能演示的原型,Trae 的 SOLO 或 Cursor 的 Agent 模式门槛最低;但要知道,原型离可上线还差安全、测试和部署三道关。
- 学生:先用免费档熟悉 Agent 的工作方式,重点学会“写清需求、让它先出计划、再分步实现、每步跑测试”,这套方法在四个工具上都通用。
安装、配置或使用步骤
结论:四款工具的安装都在 10 分钟内完成,真正决定效果的是第 4 步——写好项目规则文件。
以下是从零到能用的通用步骤:
- 只从官方渠道下载。 Claude Code 在 macOS / Linux 终端执行官方脚本安装,Windows 用 PowerShell 版本;Codex CLI 可用官方脚本或 npm 安装;Cursor 从 cursor.com 下载;Trae 从 trae.ai(国际版)或 trae.cn(国内版)下载。搜索结果里常见自称“官网”的仿冒站点,务必核对域名。
- 登录并确认额度。 Claude Code 首次运行时登录 Claude 账号(或在环境变量中设置 API Key);Codex 选择 Sign in with ChatGPT;Cursor 和 Trae 在 IDE 内登录。登录后在各自的设置或控制台查看当前套餐与剩余用量。
- 准备一个干净的项目目录并初始化 git。 每一轮改动都提交一次,方便看 diff 和回滚,这是使用任何 Agent 的安全底线。
- 写项目规则文件。 按工具放到对应位置:CLAUDE.md、
.cursor/rules/xxx.mdc、AGENTS.md 或.trae/rules/project_rules.md。内容见下方示例,四个工具可以用同一份正文。 - 设置权限。 让 Agent 可以在项目目录内读写和运行测试命令,但对删除文件、联网安装依赖、git push 等操作保持确认。Claude Code 用权限模式和允许列表控制,Codex 用审批设置控制,Cursor 和 Trae 在设置中配置终端命令的自动运行白名单。
- 先让它出计划,再动手。 第一条提示词永远是“先读需求,不要写代码,输出计划”,确认后再进入实现。
安装命令示例(摘自官方文档与官方仓库):
# Claude Code(macOS / Linux / WSL)
curl -fsSL https://claude.ai/install.sh | bash
# Claude Code(Windows PowerShell)
irm https://claude.ai/install.ps1 | iex
# Codex CLI(任选其一)
npm install -g @openai/codex
curl -fsSL https://chatgpt.com/codex/install.sh | sh
下面是我们在对照实验中使用的项目规则正文,四个工具逐字相同(Cursor 版本只是在顶部多了 alwaysApply: true 的 frontmatter):
# ShortLink Lite 项目规则
## 需求来源
- 唯一需求文档是 docs/PRD.md。与 PRD 冲突时以 PRD 为准;PRD 没写的,先问我,不要自行扩展功能。
## 技术约束
- Python 3.10+,服务端只用标准库,禁止安装或引入第三方包(测试只用 pytest)。
- 启动命令固定为 `python -m app.server`;配置全部来自环境变量 PORT / ADMIN_TOKEN / DB_PATH / BASE_URL。
- 所有 SQL 必须参数化;token 比较用 hmac.compare_digest;日志里不得出现 ADMIN_TOKEN。
## 工作方式
- 每完成一个功能就写 pytest 单元测试并实际运行,把命令和结果贴给我。
- 不要修改 acceptance/ 目录下的任何文件,它是验收标准。
- 不要删除或重写与当前任务无关的文件;改动超过 3 个文件前先列出计划。
- 回答用中文,代码注释用中文。
## 常用命令
- 单元测试:python -m pytest tests -q
- 验收测试:python acceptance/run_acceptance.py --project .
这份规则有三个关键设计:明确唯一需求来源(防止 Agent 自行扩展功能);把“不许改验收测试”写成硬性规则(防止它为了通过测试去改测试);要求每步实际运行测试并贴出结果(防止它只说“应该能通过”)。更多规则文件写法可以在站内搜索 AGENTS.md 规则文件。
实际工作流示例
结论:用“固定需求 + 固定提示词 + 自动验收”的方式对比工具,才能得到可复现的结论;我们按这个方法真实跑完了 Claude Code,结果是 7 轮约 21 分钟、零人工干预、验收 46/46。
对照项目:ShortLink Lite 短链服务
我们选了一个难度适中、但细节很多的项目:可自托管的短链接服务。需求文档(PRD)规定了 9 个功能点:创建短链、302 跳转并追加 UTM 参数、按来源统计点击、Bearer Token 鉴权、软删除后返回 410、健康检查、分页列表、重启后数据保留、请求体大小限制与错误路由处理,外加一张 11 个错误码的对照表。技术约束是 Python 3.10+、服务端只用标准库,这样任何人在 Windows 或 Linux 上都能直接运行,不受依赖安装影响。
验收测试只通过 HTTP 访问服务,共 46 条用例,因此对任何工具写出来的实现都通用。打分脚本会先用临时数据库启动服务、跑完大部分用例,再重启服务检查数据是否保留:
python run_acceptance.py --project ../03-reference-impl
为了确认测试本身有效,我们先写了一个参考实现(服务端约 410 行),验收 46/46;然后人为把“删除后返回 410”改成 404、把“UTM 不覆盖已有参数”改成覆盖,验收脚本准确检出了 3 个失败用例。
7 轮固定提示词
四个工具使用逐字相同的 7 轮提示词:R1 理解与计划、R2 骨架与存储、R3 核心功能、R4 其余功能、R5 跑验收、R6 代码审查、R7 文档收尾。第一轮是这样写的:
阅读 docs/PRD.md,先不要写任何代码。请输出:
1. 用一句话复述 F1~F9 每个功能;
2. 目录结构和模块划分(每个文件负责什么);
3. 你认为最容易做错的 5 个点;
4. 实现顺序。
输出后停下,等我确认。
第五轮是把验收交给 Agent 自己循环修复:
运行:python acceptance/run_acceptance.py --project .
逐条分析失败用例并修复实现代码。规则:不允许修改 acceptance/ 下任何文件;每轮修复后重新运行验收,直到全部通过。最后贴出验收汇总表。

Claude Code 实跑结果
运行条件:Claude Code CLI 2.1.287,日志记录的模型为 claude-sonnet-5-5,无界面模式 claude -p,第 2 轮起用 --continue 续接,权限模式为自动接受文件编辑、Bash 只放行 python / git 等命令,Linux 云端环境。7 轮提示词照抄,中间没有任何追加提示。
| 轮次 | 耗时 | 发生了什么 |
|---|---|---|
| R1 计划 | 33 秒 | 只读了 PRD 和文件列表,输出计划后停下等待确认 |
| R2 骨架 | 111 秒 | 建好配置、存储层和服务骨架,单元测试通过 |
| R3 核心功能 | 388 秒 | 完成创建、跳转、鉴权,单测 297 个;未被要求就主动跑了验收(34/46,失败项均属未做功能) |
| R4 其余功能 | 226 秒 | 完成统计、删除、列表、健壮性,单测 441 个,验收已 46/46 |
| R5 跑验收 | 13 秒 | 一次通过 46/46,并确认验收目录未被改动 |
| R6 代码审查 | 399 秒 | 自查出日志注入、重复 Content-Length、客户端断连异常等问题,先写复现测试再修复;单测 471 个 |
| R7 文档 | 95 秒 | 写出 316 行 README,并说明 PowerShell 命令未在 Windows 实际运行 |
几个值得记录的观察(本站实测,单次运行):
- 守规矩:全程没有修改验收测试、没有引入第三方依赖、没有自行 git commit。
- 会主动暴露需求空白:R3、R4 各列出了若干条“PRD 没写、我按倾向实现”的决定请人确认,例如“已删除短链的统计接口返回 200 还是 410”。这是对比其他工具时最值得观察的能力。
- 偏重:服务端 872 行、测试 2281 行,约为参考实现的 2 倍;对小项目来说有过度工程的倾向,可以在提示词里要求“最简单能通过测试的实现”。
- 成本:CLI 报告的 API 等价费用合计约 4.36 美元。使用 Pro / Max 订阅时按订阅额度计,不会单独扣这笔钱,这个数字只用于判断量级。
Cursor、Codex、Trae 三个工具本站尚未在同条件下实跑,因此这里不给出它们的成绩,也不做任何推测性排名。你可以按同样的剧本自己跑一遍,用验收脚本打分。
对比与选型建议
结论:选型的第一原则是“少换工具、写好规则”;如果确实要在几款之间做选择,用同一个项目实测比任何榜单都可靠。
| 你的情况 | 建议 | 原因 |
|---|---|---|
| 已有 ChatGPT Plus 或更高订阅 | 先用 Codex | 无需额外付费,CLI、IDE 插件、云端任务都可用 |
| 已有 Claude Pro / Max 订阅 | 先用 Claude Code | 订阅已包含,终端和 IDE 插件都能用 |
| 都没有订阅、预算有限 | Trae 免费档或 Cursor Hobby 起步 | 零成本熟悉 Agent 工作方式,再决定是否付费 |
| 团队统一采购 | 跟随现有账号体系 | 管理、SSO、发票流程比工具本身差异更影响落地 |
| 需要 CI 自动化 | Claude Code 或 Codex | 两者都能无界面运行并返回结构化日志 |
我们的编辑判断是:对大多数个人开发者,“一个 IDE 型工具 + 一个终端型工具”的组合最实用,例如 Cursor + Claude Code,或 Trae + Codex。IDE 型负责日常小改动和阅读代码,终端型负责“一次做完”的长任务和自动化。
如果你想把这套对比方法直接用起来,我们整理了两份配套资料。免费的《AI 编程工具选型一页纸》把 10 个常见场景的首选 / 备选、价格与规则文件位置压缩在一张 A4 上,打印出来对号入座即可。付费的《4 工具对照工程包》(¥99)包含本文用到的完整需求文档、46 条验收测试与一键打分脚本、参考实现、四套规则文件、7 轮提示词剧本、40 条提示词记录表、Claude Code 的完整实跑日志与代码,以及自动加权的计分表——你只需要在自己的电脑上按剧本跑一遍 Cursor、Codex、Trae,就能得到属于你自己的横评结果。
风险、限制与注意事项
结论:AI 编程工具最大的风险不是“写错代码”,而是“在你没注意时做了你没让它做的事”。
- 权限过宽:让 Agent 自动运行任意命令很方便,但它可能删除文件、安装依赖或访问网络。建议只放行测试和 git 只读类命令,删除、推送、安装保持人工确认。
- 为了通过测试去改测试:这是 Agent 最常见的“作弊”方式。把“不许修改验收目录”写进规则文件,并在每轮结束后用
git status检查。 - 密钥与隐私泄露:不要把真实 API Key、客户数据、涉密代码贴进对话。项目中的
.env文件只放占位符,并加入.gitignore。 - 仿冒官网:热门工具的搜索结果里常有仿冒下载站和“代充值”网站。只认 claude.com / claude.ai、cursor.com、chatgpt.com / openai.com、trae.ai / trae.cn 这些官方域名。
- 额度不可预测:四款工具都已转向按用量计费,长任务、强模型会快速消耗额度。重度使用前先在控制台查看用量,并设置预算上限。
- 单次实测的局限:AI 输出有随机性,模型版本也会更新。我们的 Claude Code 结果只代表 2026 年 10 月 1 日这一次运行,同一工具建议跑两次取平均。
- 代码仍需人工审查:即使验收全部通过,也要检查安全边界。我们的实测中,Claude Code 在审查轮自己发现了日志注入等问题,但前几轮写出的代码并没有考虑到这些。
事实依据与来源
官方来源(已核验):Claude 各套餐价格及是否包含 Claude Code 来自 Claude 官方价格页;Claude Code 的安装命令、多端形态、CLAUDE.md 与 AGENTS.md 读取说明来自 Claude Code 官方文档。Cursor 的 Hobby / Pro / Pro Plus / Ultra / Teams 价格、用量池与功能来自 Cursor 官方价格页与官方文档;.cursor/rules 的 .mdc 格式与四种应用模式来自 Cursor 官方规则文档。Codex 包含在哪些 ChatGPT 套餐、各档价格、使用入口来自 OpenAI 官方 Codex 价格说明;Codex CLI 的安装方式与 Apache-2.0 协议来自 OpenAI 官方 GitHub 仓库。AGENTS.md 的定义与支持工具列表来自 agents.md 官方网站。
第三方来源:Trae 的 Free / Lite / Pro / Pro+ / Ultra 价格来自 2026 年 6 月的第三方价格汇总文章,Trae 规则文件路径来自开源项目 rulesync 的整理(其引用 Trae 官方文档)。本次核验时 Trae 官方价格页与文档无法直接抓取,请以 Trae 官网为准。
本站实测:Claude Code 的 7 轮运行数据(耗时、回合、单元测试数、验收结果、代码行数、CLI 报告的费用)来自本站 2026 年 10 月 1 日的一次真实运行,完整日志保存在付费资料包中。参考实现的 46/46 验收结果与变异测试同为本站实测。
编辑判断:场景推荐表的首选 / 备选、“一个 IDE 型 + 一个终端型”的组合建议,属于编辑判断,不代表官方结论。
尚待验证:Cursor、Codex、Trae 在同一对照项目上的表现,本站尚未实跑,需要读者或后续更新补充。
内容核验日期:2026 年 10 月 1 日。
FAQ
Claude Code、Cursor、Codex、Trae 哪个最好?
没有对所有人都最好的工具。终端重度用户和需要自动化的团队更适合 Claude Code 或 Codex;习惯在编辑器里审阅改动的人更适合 Cursor 或 Trae;预算有限的初学者可以从 Trae 免费档开始。最可靠的办法是用同一个小项目把候选工具各跑一遍,按验收测试通过率和你的使用体验打分,而不是依赖别人的排行榜。
这四款工具有免费版吗?
Cursor 有 Hobby 免费档(Agent 请求有限),Codex 在 ChatGPT Free 套餐中提供基础额度,Trae 有免费档。Claude Code 不包含在 Claude 免费套餐中,需要 Pro($20/月,年付 $17/月)或更高订阅,也可以用 API Key 按量付费。免费档都适合体验和学习,日常高频使用基本都需要付费。
我已经订阅了 ChatGPT Plus,还需要买 Cursor 吗?
不一定。ChatGPT Plus 已包含 Codex,可以在终端、VS Code 插件和网页中使用,对大多数个人开发需求已经够用。只有当你非常依赖“在编辑器里逐块审阅 diff”的体验,或者 Codex 的额度不够用时,再考虑额外订阅 Cursor。先用一两周再决定,避免重复付费。
CLAUDE.md、AGENTS.md、.cursor/rules 有什么区别?要写几份?
它们都是写给 AI 的项目规则文件,只是各工具读取的位置和格式不同:Claude Code 读 CLAUDE.md,Codex 读 AGENTS.md,Cursor 读 .cursor/rules 下的 .mdc 文件,Trae 读 .trae/rules 下的 Markdown 文件。由于 Cursor、Codex 等都支持 AGENTS.md,Claude Code 也能读取它,团队可以把规则正文维护在一份文件里,其他位置引用或复制同一内容。我们的对照实验中四份规则正文逐字相同。
文中的 Claude Code 实测可信吗?其他三个为什么没测?
Claude Code 的数据来自一次真实运行:固定的 7 轮提示词、零人工干预、完整日志和最终代码都保留在资料包中,任何人都可以用验收脚本重新打分。另外三款工具需要登录各自的账号并在图形界面中操作,本站这次没有在同等条件下完成运行,因此不给成绩、不做推测排名。我们提供了同样的剧本,你可以自己补齐。
配套模板和资料在哪里下载?
免费的《AI 编程工具选型一页纸》(PDF)和付费的《4 工具对照工程包》(¥99)都在 AI Stack Nav 网站提供。付费包内包含需求文档、46 条验收测试与打分脚本、参考实现、四套规则文件、7 轮提示词剧本、提示词记录表、Claude Code 实跑记录和计分表,文件名均为英文,Windows 和 Linux 都能直接使用。
用 AI 编程工具写的代码能直接上线吗?
不建议直接上线。即使所有测试通过,也需要人工审查安全边界、权限控制和异常处理。我们的实测中,Claude Code 在前几轮写出的代码功能正确,但直到专门的审查轮才发现日志注入和连接异常等问题。上线前至少要做一次独立的代码审查,并在测试环境中运行一段时间。
参考来源
- Claude 官方价格页
- Claude Code 官方文档:概览与安装
- Cursor 官方价格页
- Cursor 官方文档:套餐与用量
- Cursor 官方文档:Rules
- OpenAI Codex 官方价格与套餐说明
- OpenAI Codex CLI 官方 GitHub 仓库
- AGENTS.md 官方网站
- Trae 官方价格页
- 第三方:Trae AI IDE Pricing 2026 汇总
- 第三方:rulesync 关于 Trae 规则与 MCP 路径的整理
内容核验日期:2026 年 10 月 1 日
工具选型与提示词资料
适合阅读工具评测、工具推荐、对比测评类文章后继续转化。