← 返回博客
04 · 实践 · Agent 实践

AI Agent 与 Codex:让 AI 做完、检查,再交付

2026-10-08 · ColaBot 编辑 · 约 623 字 · 2 分钟

用手机页面修复案例,理解目标、工具、反馈和完成条件。

Agent 把理解、行动和检查连起来:明确目标 → 使用工具 → 检查结果
检查通过才交付;环境不足时应说明未验证的部分。

1. Agent 是怎样的工作方式

你让 AI 修一个网页,希望它不只解释原因,还能读文件、修改代码、检查效果。围绕目标使用工具,并根据结果选择下一步,这就是理解 Agent 的一个入口。它需要目标、上下文、工具与反馈;缺少文件访问或运行环境,就可能只能提供建议,不能凭一句话让电脑上的真实页面发生变化。

2. 看一次具体的修复

例如手机上长任务把删除按钮挤出屏幕。让 Codex 先找到相关页面与样式,再针对原因修改,最后检查窄屏和原有功能。如果检查没通过,就根据新证据继续调整。它说“构建成功”,只证明对应构建环节通过,不能单独证明按钮可点击。你需要的是发现、修改和结果之间清楚的联系。

3. 给它清楚的完成条件

任务不要只写“优化一下”。说明复现步骤、期待行为和要保留的功能,就更容易得到能验收的结果。固定步骤的事,可以先用脚本或工作流;需要根据中间结果调整路径时,再考虑 Agent。

可以照做的练习
修复待办页:390 像素宽度下,长文字挤出删除按钮。要求文字换行、按钮可点、无横向滚动,并保留添加和完成功能。说明修改与验证结果,未验证部分要写清。

4. 工具多,不等于结果可靠

项目指令文件可以保存工作约定,Skills 可以复用任务指南,MCP 或插件可以接入工具,但它们不会自动扩大账户权限。先连接当前任务确实需要的能力,保留可恢复的版本。验收时亲自操作一次,并核对交付说明。先把一个小任务做可靠,再扩大自动化范围。

你也可以要求交付时列出“已验证”和“待验证”两项。比如已经确认样式修改,但没有可用浏览器,就由你打开页面检查。一次修复的经验还能写成项目约定,下次遇到类似问题时减少重复说明。

参考资料

资料核对日期:2026-10-08。文中的类比、练习与实施建议为 ColaBot 编辑整理,产品入口、接口和使用范围以当前官方资料及账户实际设置为准。