壹零壹玖

  • 首页
  • 归档
  • 2026

  • 2026-02-06
    用 Trace 做 AI Agent 的回归测试:从“能跑”到“可验证”
  • 2026-02-05
    给 LLM 测试加一道“Flakiness Firewall”:用可重复性检测 + 稳健聚合,把随机性挡在 CI 之外
  • 2026-02-04
    用 Playwright Trace 给“LLM 驱动的 UI 测试”做可回放取证:让 flaky 变得可诊断
  • 2026-02-03
    用“契约测试”把 AI Agent/MCP 工具调用测稳:一份 QA/平台工程实践指南
  • 2026-02-02
    Schema-First 的 LLM JSON 合同测试:把“结构化输出”做成可回归的门禁(含 Mermaid 流程图 + 反例库)
  • 2026-02-01
    把 LLM 功能当成“可回归”的产品:在 CI 里跑 Evals 的最小闭环(含门禁与漂移监控)
  • 2026-01-31
    用“变异测试”给 Prompt/Eval 找盲区:让 LLM 评测也有 Mutation Score
  • 2026-01-30
    用 SLO 驱动的负载测试:把 k6 阈值当成“可测试的可靠性合同”
  • 2026-01-29
    LLM-as-Judge 在测试工程化中的落地:从用例生成到可审计的质量门禁
  • 2026-01-29
    从 0 搭建 Clawdbot(Gateway + WebChat + Telegram/WhatsApp)
第 1 页,共 2 页
Copyright © 2016-2026 shijianliangs
  • 首页
  • 归档