各位大佬好,我想在实习工作中使用多 Agent 架构来完成需求分析->测试点编写->测试用例生成 (由于我实习公司的测试人员少,不考虑自动化),大佬们认为我有必要做多 agent 测试吗,我了解到好处就是可以尽量解决上下方腐败导致的 AI 幻觉。所以我现在是想做,但是我搜了很多网站都没有提及到多 Agent 协作测试的方法,我现在是打算用 codex 来完成,但是由于是新手使用 codex 并不了解如何使用 codex 来完成这种测试流程,希望有知道的大佬指点一下
问 ai
子代理
个人感觉测试用例拆解重要的不是工作流程,而是当前 LLM 是否了解你的项目 1.知识库内容齐全,那一个大模型就完全可以做拆解内容了 2.拆分多个大模型,个人做法线路分两条,(1)需求拆解提示词(人工审核)- 抽取知识库内容 - 整理测试用例(2)需求拆解用例 + 结合知识库用例 - 查重、整合 - 生成用例
感觉多 Agent 大概率是过度设计。 需求分析 → 测试点 → 测试用例,这三步是串行的、单向的,前一步的输出就是后一步的输入。这种流水线用一个 Agent 分三次调用就能做,多 Agent 的编排开销反而更大。 多 Agent 真正的价值在并行和对抗: 并行:三个 Agent 同时分析同一个需求的不同模块,最后汇总 对抗:一个生成用例,另一个专门挑刺(覆盖度够不够、边界漏没漏),互相制衡 你说的"上下文腐败导致幻觉",分步调用 + 每步清空上下文就能解决,不需要多 Agent。核心是每一步只喂它这一步需要的信息。 建议:先把单 Agent 跑通。 第一步:喂需求文档 → 输出功能点清单(人工过一遍) 第二步:喂功能点 → 输出测试点(人工过一遍) 第三步:喂测试点 → 输出用例(人工过一遍) 每一步都要人工卡一道。跑通之后你会发现瓶颈根本不在"Agent 数量",而在: 需求文档本身写得糊 —— AI 读不懂人也读不懂 缺少领域知识 —— 业务规则不在文档里,在老员工脑子里 用例粒度不统一 —— 这个得靠 prompt 里给例子,不是靠加 Agent
感谢建议