基本信息

来源摘要/节选

公开展示已截断至最多 800 个字符;请访问原始来源查看完整上下文。

传统 API 返回固定 JSON,写个断言就能测。Agent 的输出是非确定性的自然语言或半结构化数据 — 同样的输入,跑两次可能得到不同的结果。这让测试变成了一门"艺术"。 本章从实战出发,教你如何系统性地验证 Agent 的可用性,快速定位问题根因。 5.1 Agent 测试的核心难题 先说清楚为什么 Agent 测试和传统后端测试不一样: 对比维度 传统 API Agent 输出确定性 同输入 → 同输出 同输入 → 不同输出 验证方式 精确断言 ( assert.equal ) 模式匹配 + 人工审查 失败模式 报错 / 返回错误码 输出"看起来对但实际不对" 调试信号 堆栈跟踪、日志 Prompt 语义、模型行为 耗时 毫秒级 秒 ~ 分钟级 成本 几乎免费 每次调用都花钱 这意味着你不能简单地用 Jest 写一堆 expect(result).toBe(expected) 就完事。你需要 分层测试策略 。 5.2 分层测试策略 第一层:输入输出格式验证(必须自动化) 不管模型生成什么内容, 格式必须正确 。这是可以精确断言的部分。 // 验证生成的测试用例格式是否正确 function validateTestCaseFormat ( testCase: any ): boolean { // 必须有这些字段 const requiredFields = [ ’title' , ‘steps’ , ’expectedResult' , ‘priority’ ] for ( const field of requiredFields) { if (!testCase[field]) { console . error ( `缺少必要字段: ${field} ` ) return false } } // priority 必须是合法枚举值 const val…

来源说明

当前只保存了公开页面节选,不代表原文全文。请以原始来源为准。

本页只呈现已做哈希绑定的来源证据,不包含基于旧正文或缺失原文的扩展推断。