返回:选工具首页

做项目 · 检查结果 · 最后核验 2026-08-12

怎么检查 AI 做得对不对

不要只看着像完成了。用一张清单检查事实、功能、画面、格式和风险。

先说人话:AI 说“做完了”,不代表真的做对了。

你需要一张能打勾的检查清单,知道哪里通过、哪里失败、哪里必须自己看。

最少检查这六层

层级检查什么常见方法
格式文件、尺寸、字段、结构是否正确Schema、模板、文件解析
事实日期、价格、规则、引用是否真实官方来源、交叉核验、更新时间
逻辑结论是否能由材料推出反例、边界条件、第二模型复核
功能程序和工作流是否真的能运行Lint、类型、测试、构建、真实点击
视觉手机和桌面是否可读,画面是否符合要求截图、关键帧、对照稿
风险是否涉及隐私、付款、删除、发布或高风险结论权限检查与人工审批

写代码、处理工作、做设计,检查方法不一样

用途最低验收标准
处理工作(Work)来源能找到,数字和原材料一致,最后的文件能直接用
写代码(Coding)代码检查和测试通过,网站或程序真的能运行
做设计(Design)尺寸正确、文字无错、主体一致,在真实设备上能看清

先写标准,再让 Agent 做

不好的说法:

帮我做得专业一点。

能检查的说法:

输出一页 9:16 竖版海报;标题不超过 18 字;手机缩略图下仍能读清;只使用红、橙、金三类主色;导出前检查错别字、人物脸和安全边距。

自动检查不能替代人工判断

程序可以检查构建是否通过,却不能完全判断商业观点是否合适;模型可以核对引用,却可能漏掉来源本身已经过期。最终要把检查分成:

  • 机器可以明确判断的硬标准;
  • 需要人决定的业务与审美标准;
  • 高风险动作前必须停下来的审批点。

官方核验入口

复制给 AI · 检查结果

先说清怎样算做对,再让 AI 自己检查一遍。

不要只说“看起来不错”。把事实、功能、画面、格式和风险写成能打勾的清单。
复制后先替换方括号内容。 密码、Token、私钥和客户隐私不要贴进对话;登录、付款、发布和破坏性操作仍需由你确认。
先定标准01

执行前生成可验证的验收清单

适合任何重要任务,防止 AI 做完才发现标准没说清。

先查看内容
在执行任务之前,请先根据我的目标生成一份可验证的验收清单。现在不要开始制作。

任务:[填写]
最终成品:[填写]
使用对象:[填写]
必须保留:[填写]
绝对不能出现:[填写]

请把标准分成:事实准确、功能完整、视觉/可读性、格式交付、隐私与风险、人工最终判断。每条必须写成可以观察或测试的结果,避免“好看、专业、效果好”这类模糊词。标出哪些能自动检查、哪些必须人工看、失败后如何返工,以及达到什么条件才算停止。先让我确认清单,再开始执行。

通用规则:不要只给我知识介绍。先问最少量的必要问题,再输出明确结论、理由、成本、风险和下一步。涉及价格、权限或功能时标明核验日期并优先引用官方来源;不确定的事实必须明确说不确定。
交付审查02

对现有成品做一次分层验收

把成品和原始要求一起交给 AI,得到证据、问题和修复优先级。

先查看内容
请对我提供的成品做一次严格验收,不要因为它是你或另一个 AI 生成的就降低标准。

原始目标与要求:[粘贴]
成品或文件位置:[填写]
已知限制:[填写]

按事实、功能、视觉/可读性、格式、风险五层逐项检查。每个判断都要提供可观察证据;不能检查的项明确写“未验证”,不要猜测通过。按“阻断/重要/优化”分级列问题,并给出最小修复动作。修复后再按同一清单复检,直到达到已约定停止条件;不得擅自改变原始目标来让结果看起来通过。

通用规则:不要只给我知识介绍。先问最少量的必要问题,再输出明确结论、理由、成本、风险和下一步。涉及价格、权限或功能时标明核验日期并优先引用官方来源;不确定的事实必须明确说不确定。