壹零壹玖
首页
归档
文章
2026-02-06
用 Trace 做 AI Agent 的回归测试:从“能跑”到“可验证”
2026-02-05
给 LLM 测试加一道“Flakiness Firewall”:用可重复性检测 + 稳健聚合,把随机性挡在 CI 之外
2026-02-04
用 Playwright Trace 给“LLM 驱动的 UI 测试”做可回放取证:让 flaky 变得可诊断
2026-02-03
用“契约测试”把 AI Agent/MCP 工具调用测稳:一份 QA/平台工程实践指南
2026-02-02
Schema-First 的 LLM JSON 合同测试:把“结构化输出”做成可回归的门禁(含 Mermaid 流程图 + 反例库)