项高影响需求,来自 4 份客户材料
首次需求澄清准备
先确认关键问题,再开始做方案。
当前展示一组可核验的高影响需求样本,其中 2 项潜在冲突会影响方案范围与交付排期。
项问题会影响产品方案或排期
个需要向客户确认的问题
现在需要你的判断
Agent 不替你决定,只把需要判断的地方放到前面。
项目定义
企业软件售前需求澄清 Agent
聚焦第一次需求澄清会前,把混合客户材料转化为可追溯的需求判断与下一步行动。
人工阅读与表格整理
逐份阅读 → 复制到 Excel / Word → 人工归并 → 凭经验找冲突 → 会前列问题
信息能读懂,但无法放心用于决策
- 关键数字与范围容易漏
- 阶段、版本和对象容易误合并
- 判断缺少可回查的原文证据
上游高风险 × 边界可闭环
- 误判会放大到方案、报价与排期
- 输入和输出边界相对清楚
- 可用一次真实澄清会验证价值
客户材料
让所有结论回到原文。
当前 Demo 可真实读取并分析 TXT;PDF、Word、Excel 展示生产形态与样例回放。
检查文件格式与页面结构
已纳入分析
4 份材料,共 86 页和 3 个工作表。
调整筛选条件或尝试其他关键词。
澄清行动包
把风险变成下一步问题。
建议先确认 3 个 P0 问题,再进入产品方案与交付评估。
客户澄清问题
按对方案和排期的影响程度排序。
评测与可信度
先定义怎么失败,再谈模型多聪明。
当前只有单项目 Demo 回放证据。所有未完成的指标都明确标为目标值,不把计划包装成结果。
离线评测框架
模块指标用于定位瓶颈,端到端指标判断结果能否用于需求澄清会。
“Demo 7/7”和“Demo 1/1”仅代表当前样例人工核验结果,不能外推到真实项目。
基线与测试设计
同一批材料对比人工、通用模型单次总结和受控 Agent。
覆盖扫描 PDF、复杂 Excel、邮件、聊天记录和多阶段需求。
计划建设标注可独立确认的最小需求项、证据、冲突、缺口与严重程度,分歧再仲裁。
计划建设人工整理、通用模型单轮总结、workflow-controlled Agent。
计划建设轨迹怎么评
不评隐藏思维链,只评可审计的工具调用、状态变化、证据依赖和停止决策。
该查版本、完整性或上下文时是否真的执行。
是否为 PDF、表格、检索选择了正确能力。
每次状态变化是否由可回查证据支持。
证据不足时是否停止结论并转人工确认。
若出现虚假引用、关键数字错误或把推断写成事实,整条轨迹直接判 0 分,不用平均分掩盖致命错误。
招标书:一期覆盖 500 家;Excel:320 条记录,表头备注“清单待区域负责人补齐”。
- 解析 PDF 与 Excel
- 抽取两个门店范围口径
- 检查表头与清单完整性
- 降级为“清单未完成”信息缺口
- 请求补齐清单,不下冲突结论
- 解析 PDF 与 Excel
- 抽取 500 与 320
- 跳过完整性检查
- 直接标为潜在冲突
- 生成“到底 320 还是 500”
招标书明确要求对接 ERP;项目包中没有接口清单、协议、负责人或附件引用。
- 抽取 ERP 集成需求
- 检索全部项目材料与附件引用
- 运行接口依赖 checklist
- 确认资料与负责人均缺失
- 停止工作量估算,生成补材料行动
- 抽取 ERP 集成需求
- 检索 4 份材料,无匹配
- 检查接口清单、协议、owner
- 标记为 P0 信息缺口
- 向客户 IT 架构师生成澄清问题
为什么这里不是纯 Workflow
外层阶段固定,阶段内“下一步查什么”由 Agent 根据语义证据动态选择。
面对 500 与 320,固定流程很容易直接得到“数量不一致”。若要覆盖版本、阶段、清单完整性、邮件附件等情况,需要不断增加分支。
看到 320 来自 Excel 后,Agent 可以决定检查表头备注、有效行、文件版本和邮件上下文;发现“待补齐”后,改变状态并停止冲突结论。
因此产品不是“Agent 替代 Workflow”,而是:Workflow 固定权限、阶段和停止线;Agent 只在白名单工具内决定下一项证据调查。若任务能被稳定规则穷举,就应优先用 Workflow。
使用率低,先看用户掉在哪一层
漏斗定位“发生在哪里”,任务观察和访谈再解释“为什么”。以下数字仅用于展示诊断方法,不是上线实测结果。