适合刚开始尝试 AI 的业务负责人,也适合已有多个想法、需要确定优先级的团队。对于无法合法提供材料、无法评价结果或无人承担审核责任的场景,需要补齐这些条件后再开始。

一页需求应包含什么

  1. 业务目标:描述当前工作中的问题,例如整理材料耗时,而不是笼统写「全面智能化」。
  2. 任务过程:谁发起任务,输入是什么,处理后交给谁;哪些步骤需要批准才能执行。
  3. 数据边界:材料来源、可使用范围、是否需要脱敏、是否允许交给外部服务处理。
  4. 结果标准:需要的格式、必填项、事实核查要求,以及可接受的人工修改量。
  5. 约束与责任:人数、预算范围、时间安排、现有系统、内部负责人及复核人。

一页纸写不下时,说明范围还太大。拆成几个任务,每个任务单独一页。

一页纸样例

下表为虚构示例,公司与数字均为假设。

栏目 填写示例
任务名称 每周竞品公开资料摘要
现状 市场部 2 人每周各花约半天,从公开网页和公告整理一份摘要
输入 已列入清单的公开网页、公告 PDF;不含内部资料
输出 一页中文摘要:每家公司 3 条要点,每条附原文链接
人工复核 市场经理核对事实与链接后再发出
数据边界 只用公开资料;不上传客户名单、合同或未发布信息
验收标准 连续 4 周,要点均有出处,复核修改不超过三分之一
使用人数 先 2 人试用,确认后扩大到市场部 8 人
负责人 业务:市场经理;账号与审批:IT 管理员
时间 试用 4 周,月底评估

这份表也可以作为需求单模板的补充,一起发给合作方。

如何挑选第一个任务

比较任务频率、材料可得性、错误影响与复核成本。给每个候选任务按下面四项打分(1 到 3 分),从总分高、且「错误影响」不是 3 分的任务做起。

维度 1 分 3 分
频率 每季度一次 每天或每周多次
材料 需要新收集或审批 已有、可合法使用
复核 难以判断对错 人能快速核对
错误影响 出错可以直接改 出错影响客户、资金或合规

把现有人工流程的结果与耗时记录下来,作为之后评估的基线。没有基线,就无法说明 AI 是否带来了改善。

验证怎么设计

  1. 固定样本:选 10 到 30 份有代表性、允许使用的材料,验证期间不更换。
  2. 固定标准:按一页纸里的验收标准逐份评分,记录需要人工修改的地方。
  3. 记录全部结果:失败、超时和需要重做的情况都要记,不只保留最好的一次。
  4. 记录用量:用 WorkBuddy 时记录 Credits 消耗,用模型 API 时记录 Token 用量,后续估算成本要用。
  5. 结论分级:可以推广、需要调整后再试、暂不适合,三选一,并写明原因。

采购数量与扩大范围,放在固定样本验证之后讨论。没有实际数据时,不预先承诺节省百分比。

需求阶段常见的四个偏差

  • 从工具出发找任务:任务定义清楚之后,才能判断工具是否合适。
  • 一次覆盖全部门:范围越大越难验收,从一个小组、一个任务开始。
  • 忽略数据边界:把内部资料交给外部服务之前,确认内部制度和合同是否允许。
  • 把对外服务和内部使用混为一谈:向公众提供生成式 AI 服务需要遵守《生成式人工智能服务管理暂行办法》等规定;企业内部使用也应有自己的审批规则。

常见问题

一次提交很多需求会不会更好?

可以列出总清单,但建议为每项分别写明负责人、输入与验收标准。不同任务可能需要不同产品或合作方式,不必打包成一个未经验证的大项目。

应该从工具开始还是从任务开始?

从任务开始。任务写清楚后,对照官方说明和验证结果判断产品是否合适;买了工具,流程并不会自动改变。

没有技术人员能否开始?

可以先描述业务任务。涉及系统接入、账号权限或数据处理时,再由有权限的人员参与确认;不要为了试验绕过内部审批。

验证要多长时间?

取决于任务频率。每周一次的任务至少观察 4 次;每天发生的任务,一到两周通常能积累足够样本。

参考资料

  1. 腾讯 WorkBuddy 官方产品入口(新窗口)
  2. 中央网信办:生成式人工智能服务管理暂行办法(新窗口)

官方资料用于核对产品或通用概念,不构成对易AI的授权、认证或背书。具体合作以双方确认的方案为准。

对应业务

企业 AI 应用

易AI 是 WorkBuddy 代理商,团队统一采购可联系我们确认版本、报价、授权期限与开通时间。

咨询合作了解这项服务