适合刚开始尝试 AI 的业务负责人,也适合已有多个想法、需要确定优先级的团队。对于无法合法提供材料、无法评价结果或无人承担审核责任的场景,需要补齐这些条件后再开始。
一页需求应包含什么
- 业务目标:描述当前工作中的问题,例如整理材料耗时,而不是笼统写「全面智能化」。
- 任务过程:谁发起任务,输入是什么,处理后交给谁;哪些步骤需要批准才能执行。
- 数据边界:材料来源、可使用范围、是否需要脱敏、是否允许交给外部服务处理。
- 结果标准:需要的格式、必填项、事实核查要求,以及可接受的人工修改量。
- 约束与责任:人数、预算范围、时间安排、现有系统、内部负责人及复核人。
一页纸写不下时,说明范围还太大。拆成几个任务,每个任务单独一页。
一页纸样例
下表为虚构示例,公司与数字均为假设。
| 栏目 | 填写示例 |
|---|---|
| 任务名称 | 每周竞品公开资料摘要 |
| 现状 | 市场部 2 人每周各花约半天,从公开网页和公告整理一份摘要 |
| 输入 | 已列入清单的公开网页、公告 PDF;不含内部资料 |
| 输出 | 一页中文摘要:每家公司 3 条要点,每条附原文链接 |
| 人工复核 | 市场经理核对事实与链接后再发出 |
| 数据边界 | 只用公开资料;不上传客户名单、合同或未发布信息 |
| 验收标准 | 连续 4 周,要点均有出处,复核修改不超过三分之一 |
| 使用人数 | 先 2 人试用,确认后扩大到市场部 8 人 |
| 负责人 | 业务:市场经理;账号与审批:IT 管理员 |
| 时间 | 试用 4 周,月底评估 |
这份表也可以作为需求单模板的补充,一起发给合作方。
如何挑选第一个任务
比较任务频率、材料可得性、错误影响与复核成本。给每个候选任务按下面四项打分(1 到 3 分),从总分高、且「错误影响」不是 3 分的任务做起。
| 维度 | 1 分 | 3 分 |
|---|---|---|
| 频率 | 每季度一次 | 每天或每周多次 |
| 材料 | 需要新收集或审批 | 已有、可合法使用 |
| 复核 | 难以判断对错 | 人能快速核对 |
| 错误影响 | 出错可以直接改 | 出错影响客户、资金或合规 |
把现有人工流程的结果与耗时记录下来,作为之后评估的基线。没有基线,就无法说明 AI 是否带来了改善。
验证怎么设计
- 固定样本:选 10 到 30 份有代表性、允许使用的材料,验证期间不更换。
- 固定标准:按一页纸里的验收标准逐份评分,记录需要人工修改的地方。
- 记录全部结果:失败、超时和需要重做的情况都要记,不只保留最好的一次。
- 记录用量:用 WorkBuddy 时记录 Credits 消耗,用模型 API 时记录 Token 用量,后续估算成本要用。
- 结论分级:可以推广、需要调整后再试、暂不适合,三选一,并写明原因。
采购数量与扩大范围,放在固定样本验证之后讨论。没有实际数据时,不预先承诺节省百分比。
需求阶段常见的四个偏差
- 从工具出发找任务:任务定义清楚之后,才能判断工具是否合适。
- 一次覆盖全部门:范围越大越难验收,从一个小组、一个任务开始。
- 忽略数据边界:把内部资料交给外部服务之前,确认内部制度和合同是否允许。
- 把对外服务和内部使用混为一谈:向公众提供生成式 AI 服务需要遵守《生成式人工智能服务管理暂行办法》等规定;企业内部使用也应有自己的审批规则。
常见问题
一次提交很多需求会不会更好?
可以列出总清单,但建议为每项分别写明负责人、输入与验收标准。不同任务可能需要不同产品或合作方式,不必打包成一个未经验证的大项目。
应该从工具开始还是从任务开始?
从任务开始。任务写清楚后,对照官方说明和验证结果判断产品是否合适;买了工具,流程并不会自动改变。
没有技术人员能否开始?
可以先描述业务任务。涉及系统接入、账号权限或数据处理时,再由有权限的人员参与确认;不要为了试验绕过内部审批。
验证要多长时间?
取决于任务频率。每周一次的任务至少观察 4 次;每天发生的任务,一到两周通常能积累足够样本。
参考资料
官方资料用于核对产品或通用概念,不构成对易AI的授权、认证或背书。具体合作以双方确认的方案为准。