• 感觉多 Agent 大概率是过度设计。
    需求分析 → 测试点 → 测试用例,这三步是串行的、单向的,前一步的输出就是后一步的输入。这种流水线用一个 Agent 分三次调用就能做,多 Agent 的编排开销反而更大。
    多 Agent 真正的价值在并行和对抗:
    并行:三个 Agent 同时分析同一个需求的不同模块,最后汇总
    对抗:一个生成用例,另一个专门挑刺(覆盖度够不够、边界漏没漏),互相制衡
    你说的"上下文腐败导致幻觉",分步调用 + 每步清空上下文就能解决,不需要多 Agent。核心是每一步只喂它这一步需要的信息。
    建议:先把单 Agent 跑通。
    第一步:喂需求文档 → 输出功能点清单(人工过一遍)
    第二步:喂功能点 → 输出测试点(人工过一遍)
    第三步:喂测试点 → 输出用例(人工过一遍)
    每一步都要人工卡一道。跑通之后你会发现瓶颈根本不在"Agent 数量",而在:
    需求文档本身写得糊 —— AI 读不懂人也读不懂
    缺少领域知识 —— 业务规则不在文档里,在老员工脑子里
    用例粒度不统一 —— 这个得靠 prompt 里给例子,不是靠加 Agent