Testing on the Toilet
Google「Testing on the Toilet」工程实践的 Agent Skill:把测试编写与评审的成熟方法论固化为编码 Agent 可执行的规则。
评分明细
适用场景
这是什么?适合谁?
Testing on the Toilet(shamashel/testing-on-the-toilet)是一个把 Google「Testing on the Toilet」工程实践固化的 Agent Skill:将测试编写与评审的成熟方法论变成编码 Agent 可执行的规则。
核心价值:把 Google 的测试工程文化(Testing on the Toilet 系列)翻译成 Agent 可执行的规则——让编码 Agent 写测试、审测试时有章可循,传承成熟方法论。
适合人群:
- 想让 Agent 写出更好测试的开发者
- 推广测试工程文化的团队
- 研究 Agent 测试能力的工程师
使用前提:一个编码 Agent(Claude Code 等);项目有测试需求。
准备工作
- 编码 Agent:Skill 面向编码 Agent。
- 安装:作为 Skill 安装。
- 测试框架:项目需有测试框架。
- 成本:公开仓库,license 需确认;Agent 调用按模型计费。
- 时间预算:安装 + 第一次用规则写测试约 10 分钟。
快速上手(3 步)
第一步:安装 Skill
git clone https://github.com/shamashel/testing-on-the-toilet ~/.claude/skills/testing-on-the-toilet
第二步:了解测试规则
阅读 Skill 中的测试编写与评审原则。
第三步:让 Agent 写/审测试
让 Agent 按规则编写或评审测试用例。
成功判定:让 Agent 按规则为一个函数写出结构清晰、断言合理的测试用例。
初级用法
测试规则
把 Testing on the Toilet 的实践固化为规则。
测试编写
指导 Agent 编写规范测试。
测试评审
指导 Agent 评审测试质量。
高级玩法
边界用例
引导 Agent 覆盖边界与异常场景。
可读性优先
强调测试的可读性与维护性。
与 CI 结合
把测试规则融入持续集成流程。
小技巧
- 先看规则清单:了解原则再让 Agent 执行。
- 测试要可读:好的测试像文档。
- 断言要具体:模糊断言价值低。
- 覆盖边界:正常路径之外的场景。
- 看许可证:仓库无明确 license,商用前确认。
常见踩坑
踩坑 1:测试流于形式
- 现象:只求覆盖率不求质量。
- 原因:把覆盖率当唯一目标。
- 解决:强调断言质量与边界覆盖。
踩坑 2:规则理解偏差
- 现象:Agent 写的测试不符合原则。
- 原因:规则不够具体。
- 解决:在任务里重申关键原则。
踩坑 3:许可证不明
- 现象:商用有法律风险。
- 原因:仓库未声明 license。
- 解决:商用前确认授权。
踩坑 4:Agent 不触发 Skill
- 现象:装完没生效。
- 原因:安装路径或触发问题。
- 解决:按 README 确认。
踩坑 5:项目较新
- 现象:规则集仍在完善。
- 原因:项目 2026-08 创建。
- 解决:关注更新。
常见问题 FAQ
Q1: Testing on the Toilet 是什么?
A: Google 内部的测试工程系列文章,分享测试编写与评审的实践。
Q2: 它和测试框架有什么区别?
A: 它提供规则/方法论,测试框架提供执行工具,两者配合。
Q3: 免费吗?
A: 公开仓库但无明确 license,商用需确认;Agent 调用按模型计费。
Q4: 支持哪些 Agent?
A: 面向编码 Agent,具体兼容以 README 为准。
Q5: 适合新手吗?
A: 适合,规则帮助新手建立正确测试习惯。
进阶学习建议
掌握基础后,建议深入:
- 把规则清单内化,写测试时自觉遵循。
- 结合项目定制测试规则,形成团队规范。
- 把测试评审接入代码评审流程。
参考链接
最后更新:2026-08-29 · 作者:MagicNetWorld · 基于公开资料整理,关键数据经 GitHub API 独立实测核验,AI 辅助生成
📊 评分与标签
评分说明
总分 7.5/10 · S_入选
📊 可观测社区指标(采集日期:2026-08-29)
- GitHub: shamashel/testing-on-the-toilet ★29, 🔱0(GitHub API 实时验证)
- License: 未声明;仓库创建 2026-08-27,最后推送 2026-08-27(活跃)
- 语言: 无(Skill 文档);定位「把 Google 测试工程文化固化为 Agent 规则」
📦 可安装性 1.9/2.5
- 克隆即用的 Agent Skill,安装简单
- 来源:官方仓库
- 竞品对比 1(通用测试 Skill):无方法论沉淀
- 竞品对比 2(人工测试):可靠但慢
🎯 实用性 1.9/2.5
- 测试工程是刚需,方法论有 Google 实践背书
- 来源:官方仓库
- 竞品对比 1(测试框架):只提供工具非方法论
- 竞品对比 2(测试教程):偏知识
📖 文档质量 1.5/2.0
- 规则清晰、可直接执行
- 来源:官方仓库
- 竞品对比 1(测试文档):非可执行规则
- 竞品对比 2(通用 Skill):无测试聚焦
👥 社区活跃 1.1/1.5
- ★29 🔱0,社区小
- 来源:官方仓库
- 竞品对比 1(个人测试 Skill):社区更小
- 竞品对比 2(方法论项目):有实践背书
🔗 兼容性 1.1/1.5
- 面向编码 Agent,通用性较好
- 来源:官方仓库
- 竞品对比 1(单平台 Skill):兼容窄
- 竞品对比 2(跨 Agent Skill):更通用
评分依据可追溯至公开来源,每项分数均有明确理由和数据支撑。
🏷️ 标签说明
- 测试工具: 面向测试工程。来源:官方仓库
- 开源: 公开仓库、源码可访问。来源:官方仓库
- 测试工程: 测试方法论。来源:官方仓库
- 代码评审: 含测试评审。来源:官方仓库
- Skill: Agent Skill 形态。来源:官方仓库
📋 来源核实
- ✅ 已验证: GitHub 仓库 - stars/forks/license/pushed_at/语言经 GitHub API 实时核验(2026-08-29)
- ✅ 已验证: 官方 README - 能力与定位比对
- ⚠️ 未实测: Agent 按规则写/审测试的端到端流程
- ⚠️ 未验证: 测试质量提升的实际效果
⚠️ 局限与未实测声明
- 本文基于 2026-08-29 GitHub 公开信息整理,未实际运行 Testing on the Toilet
- 无明确 license,商用需确认;规则效果未经量化验证
- 项目较新,能力与命令以仓库 README 为准