本模块关注 Agent 最容易在演示中被隐藏的部分:失败会跨步骤传播,结果具有随机性,权限越大风险越高,多 Agent 还会放大成本与沟通误差。课程最终用可重复评估,而不是一次成功演示,判断系统是否可靠。
模块项目
完成“可审计的公司研究 Agent”:提交 Agent spec、工具权限表、10 个黄金样本、完整 trace、单次成本与时延,以及一次失败复盘。评分拆成事实、来源、完整性、反例和成本五项。
模块检查点
让系统处理 ResearchCo 的修订公告、Prompt injection 片段和一次工具超时,提交三条完整 trace。用同一组 eval 比较单 Agent 与多 Agent:只有事实准确率或证据对齐出现可重复增益,且成本与时延在预算内,才允许采用多 Agent。