先说人话:AI 说“做完了”,不代表真的做对了。
你需要一张能打勾的检查清单,知道哪里通过、哪里失败、哪里必须自己看。
最少检查这六层
| 层级 | 检查什么 | 常见方法 |
|---|---|---|
| 格式 | 文件、尺寸、字段、结构是否正确 | Schema、模板、文件解析 |
| 事实 | 日期、价格、规则、引用是否真实 | 官方来源、交叉核验、更新时间 |
| 逻辑 | 结论是否能由材料推出 | 反例、边界条件、第二模型复核 |
| 功能 | 程序和工作流是否真的能运行 | Lint、类型、测试、构建、真实点击 |
| 视觉 | 手机和桌面是否可读,画面是否符合要求 | 截图、关键帧、对照稿 |
| 风险 | 是否涉及隐私、付款、删除、发布或高风险结论 | 权限检查与人工审批 |
写代码、处理工作、做设计,检查方法不一样
| 用途 | 最低验收标准 |
|---|---|
| 处理工作(Work) | 来源能找到,数字和原材料一致,最后的文件能直接用 |
| 写代码(Coding) | 代码检查和测试通过,网站或程序真的能运行 |
| 做设计(Design) | 尺寸正确、文字无错、主体一致,在真实设备上能看清 |
先写标准,再让 Agent 做
不好的说法:
帮我做得专业一点。
能检查的说法:
输出一页 9:16 竖版海报;标题不超过 18 字;手机缩略图下仍能读清;只使用红、橙、金三类主色;导出前检查错别字、人物脸和安全边距。
自动检查不能替代人工判断
程序可以检查构建是否通过,却不能完全判断商业观点是否合适;模型可以核对引用,却可能漏掉来源本身已经过期。最终要把检查分成:
- 机器可以明确判断的硬标准;
- 需要人决定的业务与审美标准;
- 高风险动作前必须停下来的审批点。
官方核验入口
复制给 AI · 检查结果
先说清怎样算做对,再让 AI 自己检查一遍。
不要只说“看起来不错”。把事实、功能、画面、格式和风险写成能打勾的清单。复制后先替换方括号内容。 密码、Token、私钥和客户隐私不要贴进对话;登录、付款、发布和破坏性操作仍需由你确认。
先定标准01
执行前生成可验证的验收清单
适合任何重要任务,防止 AI 做完才发现标准没说清。
先查看内容
在执行任务之前,请先根据我的目标生成一份可验证的验收清单。现在不要开始制作。 任务:[填写] 最终成品:[填写] 使用对象:[填写] 必须保留:[填写] 绝对不能出现:[填写] 请把标准分成:事实准确、功能完整、视觉/可读性、格式交付、隐私与风险、人工最终判断。每条必须写成可以观察或测试的结果,避免“好看、专业、效果好”这类模糊词。标出哪些能自动检查、哪些必须人工看、失败后如何返工,以及达到什么条件才算停止。先让我确认清单,再开始执行。 通用规则:不要只给我知识介绍。先问最少量的必要问题,再输出明确结论、理由、成本、风险和下一步。涉及价格、权限或功能时标明核验日期并优先引用官方来源;不确定的事实必须明确说不确定。
交付审查02
对现有成品做一次分层验收
把成品和原始要求一起交给 AI,得到证据、问题和修复优先级。
先查看内容
请对我提供的成品做一次严格验收,不要因为它是你或另一个 AI 生成的就降低标准。 原始目标与要求:[粘贴] 成品或文件位置:[填写] 已知限制:[填写] 按事实、功能、视觉/可读性、格式、风险五层逐项检查。每个判断都要提供可观察证据;不能检查的项明确写“未验证”,不要猜测通过。按“阻断/重要/优化”分级列问题,并给出最小修复动作。修复后再按同一清单复检,直到达到已约定停止条件;不得擅自改变原始目标来让结果看起来通过。 通用规则:不要只给我知识介绍。先问最少量的必要问题,再输出明确结论、理由、成本、风险和下一步。涉及价格、权限或功能时标明核验日期并优先引用官方来源;不确定的事实必须明确说不确定。