什么能交给 AI
一套三秒钟就能跑完的信任判断法。
一套三秒钟就能跑完的信任判断法。 面对「能不能交给 AI」这个问题,最常见的两种回答都错了:全交,或者全不交。正确的回答不是对 AI 的态度,而是对任务的判断——三秒钟,三个问题。 你会遇到的现象:
- 所有事都丢给 AI,出一次事就全盘撤回
- 因为怕出错,什么都不敢交,AI 形同虚设
- 「反正它只是建议,出不了大事」——结果真出了
三问判断法
**① 错了可不可逆?**发出去的邮件能撤回吗?删掉的文件能找回吗?付出去的钱能退吗?**不可逆 → 别让 AI 自动执行。**可逆(草稿、初稿、临时内容)→ 尽管交给它,错了重来。
**② 影响面多大?**错了只影响这一个人、这一条数据,还是全体用户、整个生产环境?**影响全体 → 留一道人工关卡。**影响单个、可局部修复 → 可以放给 AI。
**③ 能不能核验?**它做完了,你能看出对不对吗?有出处、有标准答案、可以检查 → 放心。它编了你都不知道(而模型极擅长这个)→ 谨慎。
三问里只要有一问「否」,结论就是:**降级——要么加人工确认,要么缩小范围。**AI Incident Database 里收录的大量事故,多数都能从这三问里找到根子:不可逆的操作被自动执行、影响被低估、核验被省略。incident-db
四类任务
**全绿灯(可逆、影响小、可核验)→ 全自动。**生成初稿、格式转换、写标题、整理摘要。这类是最该交给 AI 的——量大、可改、错了无伤大雅。
**需人工确认(不可逆或影响大)→ 让 AI 做,人点头。**发邮件、提交订单、发布内容。AI 干重活,人按最后一个按钮。这是权限分级里「人工断点」的典型位置。
**需核验(不可靠但可查)→ 让 AI 做,人检查。**总结外部资料、翻译合同、提取数据。AI 出初稿,人按关键点核验——用三个动作筛掉大部分编造。
**别交(三问里「否」得太严重)→ 自己做。**关键决策、涉及生命财产、无法核验的不可逆操作。有些事永远不该交。欧盟 AI 法案把高风险场景单独立了门槛,思路是一样的:后果重到一定程度,就不能光靠模型自觉。eu-ai-act
注意:**类别不是固定的。**同一个任务,加了核验环节就能从「别交」升到「需核验」;设了人工确认就能从「别交」升到「需人工确认」。改善的不是 AI,是你的流程设计。
最容易滑过的边界
有几类任务,表面看「可以交」,实际很危险:
一、看似可逆实则不可逆。「先把这段删了」——但那是唯一副本。判断可逆要看有没有备份和恢复路径,不是看操作本身。
二、影响被低估。「就发一封内部邮件」——但这封邮件会转给客户。影响面的评估要按最坏传播算,不是按直接受众算。
三、核验被省略。「它就是总结一下,不用查」——模型编造的自信程度远高于人的预期。越是「看起来不用核验」的任务,越要问一句:真出事了我能不能知道?安全圈子对 LLM 应用的威胁建模,同样把权限失控和过度授权列为高危项。owasp-llm
最后,把这个判断法用在产品设计上:**别设计一个「全自动」的 AI 功能。**设计时就想清楚每个环节属于哪一类,把人工断点和核验点提前放进流程。信任不是靠祈祷,是靠设计。
