壹零壹玖
首页
归档
2026
2026-02-06
用 Trace 做 AI Agent 的回归测试:从“能跑”到“可验证”
2026-02-05
给 LLM 测试加一道“Flakiness Firewall”:用可重复性检测 + 稳健聚合,把随机性挡在 CI 之外
2026-02-04
用 Playwright Trace 给“LLM 驱动的 UI 测试”做可回放取证:让 flaky 变得可诊断
2026-02-03
用“契约测试”把 AI Agent/MCP 工具调用测稳:一份 QA/平台工程实践指南
2026-02-02
Schema-First 的 LLM JSON 合同测试:把“结构化输出”做成可回归的门禁(含 Mermaid 流程图 + 反例库)
2026-02-01
把 LLM 功能当成“可回归”的产品:在 CI 里跑 Evals 的最小闭环(含门禁与漂移监控)
2026-01-31
用“变异测试”给 Prompt/Eval 找盲区:让 LLM 评测也有 Mutation Score
2026-01-30
用 SLO 驱动的负载测试:把 k6 阈值当成“可测试的可靠性合同”
2026-01-29
LLM-as-Judge 在测试工程化中的落地:从用例生成到可审计的质量门禁
2026-01-29
从 0 搭建 Clawdbot(Gateway + WebChat + Telegram/WhatsApp)
第 1 页,共 2 页