TOOL工具箱

AI 任务简报:从问题到人工验收

10 张卡片 4 分钟 1,661 字
本篇要点

在 AI 学习或项目开始前写清真实任务、数据边界、来源、评估集、人工责任、成本、失败处理和交接条件。

01

开篇

复制到私有项目目录,在模型调用前填写。它不是 prompt 收集器,而是一张开始许可:如果任务、数据、来源、验收或责任人仍然不清楚,就先不要让模型生成最终结果。

不要写入密码、证件、精确住址、医疗隐私、儿童数据、客户记录、未公开漏洞或无权使用的第三方内容。敏感材料先脱敏,或改用组织批准的环境。

01 / 10 144 字
02

1. 任务与责任

# AI Task Brief - YYYY-MM-DD

真实场景:
使用者/受众:
要完成的决策或动作:
为什么现在做:
截止时间与不可错过的节点:
最终负责人与人工审阅者:
如果不做或延迟,谁会受影响:

把“学 AI”“做一个智能助手”改成可观察的动作,例如“用户能在 10 分钟内导入一份文件,并看到一份能解释来源和错误的报告”。

02 / 10 152 字
03

2. 输入、来源与数据边界

输入/主张 类型 来源、版本与位置 可否提供给模型 核验人 失效条件
事实 / 推断 / 个人经验 / 用户数据 / 第三方内容 公开 / 脱敏 / 组织批准 / 禁止
允许使用的文件和字段:
明确不提供的材料:
数据敏感等级:公开 / 内部 / 机密 / 受限
收集、传输、留存和删除期限:
是否取得必要同意:
版权、许可证、引用和署名要求:
模型能接触的最小数据范围:

来源不等于真相。每个关键主张要能回到原文、版本、数据口径或直接观察;模型给出的链接、数字和引语仍需人工核验。

03 / 10 206 字
04

3. 输出与评估集

最终交付物:
格式、长度和受众:
可观察的完成标准:
必须通过的硬门:
允许的可接受变体:
明确不能出现的内容:

建立一份小而真实的评估集,不要只用模型最擅长的示例:

样本 输入条件 预期结果 不可接受结果 实测结果 证据位置
正常样本
边界样本
缺失/冲突输入
真实历史样本(已脱敏)

验收至少回答:事实是否可追溯,关键动作是否完成,错误是否可见,权限是否正确,失败是否可停止。流畅、快速或“像人”不是验收标准。

04 / 10 190 字
05

4. AI 的工作范围

AI 可以做:提问 / 分类 / 候选解释 / 反例 / 转写 / 草稿 / 测试建议
AI 不可以做:最终事实判断 / 虚构来源 / 代替责任人批准 / 越过权限
                    / 完成禁止外部帮助的考试或申请 / 自动发布
使用模式:诊断 / 辅助 / 生成候选 / 批量处理 / 其他
模型、版本、区域和调用日期:
提示词、系统指令或工作流版本位置:

先让模型复述目标、输入、限制、未知项和验收,再开始生成。提示词版本化;不要把一次聊天窗口当作唯一的项目记录。

05 / 10 189 字
06

5. 人工门

门 必须由谁确认 通过证据 未通过时
来源门 原始链接、版本、位置 标记未核验,不传播
事实门 抽样核对、数据口径 删除或降级主张
隐私/权限门 数据范围、同意、访问日志 停止处理并脱敏
质量门 评估集、边界样本、真实反馈 修复、缩小或拒绝交付
成本门 token、时间、人工返工与预算 降级模型或停止
责任门 具名批准和披露文字 不发布、不自动执行

关键决定不能只由生成模型、自动评分或单个开发者自己批准。高风险领域回到当前一手材料和合格专业人员。

06 / 10 203 字
07

6. 成本、留存与可逆性

预计调用量、时间和费用上限:
人工审阅与返工预算:
数据是否进入训练、日志或第三方留存:
可接受延迟与降级方案:
可以撤回、重跑或恢复到哪个版本:
发布范围与灰度对象:

一次便宜的调用如果造成隐私事件、错误决定或大量返工,真实成本并不便宜。记录模型费用之外的人工时间、审阅、失败、重跑和沟通成本。

07 / 10 142 字
08

7. 失败、暂停与回滚

触发条件 立即动作 通知谁 恢复/回滚位置
找不到来源或版本 停止传播,回到原始材料
评估集硬门失败 禁止发布或自动执行
输入越过权限边界 停止上传,撤销访问
成本/延迟超过上限 降级、限流或停止
真实用户报告伤害 下线、保留证据、升级处理

如果没有明确的停止人、通知路径和已知可用版本,就还没有准备好接入真实流程。

08 / 10 144 字
09

8. 交接与公开说明

当前状态:未开始 / 实验 / 内部试用 / 灰度 / 已交付 / 已停止
已完成与证据位置:
未决问题和风险:
下一项最小任务:
交接负责人、时间和权限:
读者/用户需要知道的 AI 参与范围:
来源、隐私、版权和利益关系说明:

交接者不应需要翻找聊天记录才能知道下一步。公开文本至少说明工具参与了哪一步、哪些事实由人确认、哪些内容仍是候选。

09 / 10 153 字
10

9. 开始前检查

  • 真实受众、动作、截止时间和负责人已写清;
  • 输入字段、敏感等级、同意、版权和留存边界已确认;
  • 关键来源、版本和失效条件可回溯;
  • 正常、边界、冲突和历史脱敏样本已进入评估集;
  • AI 可以做与不可以做的范围已写清;
  • 人工门、费用上限、停止条件和回滚位置已指定;
  • 交接、披露和下一次复查日期已确定。
10 / 10 138 字