Install
$ agentstack add skill-lumiogames-workflow-plugin-test-driven-development ✓ scanned · ✓ verified, works with Claude Code, Cursor, and more.
Security review
✓ PassedNo issues found. Passed automated security review. · v0.1.0 How review works →
- ✓ Prompt-injection patterns
- ✓ Secret / credential exfiltration
- ✓ Dangerous shell & filesystem operations
- ✓ Untrusted network calls
- ✓ Known-malicious package signatures
What it can access
- ✓ Network access No
- ✓ Filesystem access No
- ✓ Shell / process execution No
- ✓ Environment & secrets No
- ✓ Dynamic code execution No
From automated source analysis of v0.1.0. “Used” means the capability is present in the source — more access means more to trust, not that it’s unsafe.
Verified badge
Passed review? Show it. Paste this badge into your README, it links to the public security report.
Reliability & compatibility
Declared compatibility
Compatibility is declared by the source manifest. End-to-end runtime verification is coming, see below.
We're building live execution health for every listing: tool-call success rate, median latency, uptime, and last-checked timestamps, measured, not self-reported. It isn't live yet, so we don't show numbers we can't stand behind.
How agent discovery & health will work →About
test-driven-development — 先写失败的测试
概述
先写测试,看它失败,再写刚好让它通过的代码。
核心原则:没看过测试失败,就不知道它测的是不是对的东西。
定位:TDD 是一种方法,用它就守它的规矩——先有失败的测试,再有生产代码。它不是推分支前的门:推分支前不要求跑任何命令——红是待办,不是门;交回物里如实写「跑了什么 / 什么都没跑」即可。
何时用
- 新功能、bug 修复、重构、行为变更——凡是要写生产代码、且目标行为能被自动化测试捕获的。
- 例外(先问用户):一次性原型、生成代码、确实没有可自动化测试缝的行为——此时用最近层级的合同 / 仪器化 / 手工验证替代,并在交回物里写明测试性缺口。
用 TDD 时想「这次先跳过、以后补」——停下。写在实现之后的测试只能证明「它现在做什么」,写在前面的才证明「它应该做什么」。
用 TDD 时的规矩
先有失败的测试,再有生产代码
先写了代码再补测试?把代码删掉,从测试重来。不留作「参考」、不「边写测试边改」、不再看它。基于测试重新实现。
红 — 绿 — 重构
红:写失败测试 → 验证它正确地失败 → 绿:最小实现 → 验证全部通过 → 重构(保持绿)→ 下一个
红:写一个会失败的测试
写一个最小的测试,说明应该发生什么。
test('retries failed operations 3 times', async () => {
let attempts = 0;
const operation = () => {
attempts++;
if (attempts
```typescript
test('retry works', async () => {
const mock = jest.fn()
.mockRejectedValueOnce(new Error())
.mockRejectedValueOnce(new Error())
.mockResolvedValueOnce('success');
await retryOperation(mock);
expect(mock).toHaveBeenCalledTimes(3);
});
名字含糊、测的是 mock 不是代码
要求:一个行为;名字说清行为;用真实代码(非不得已不用 mock)。
验证红:看着它失败
跑这个测试。确认:
- 是失败,不是报错
- 失败信息符合预期
- 失败原因是功能缺失,不是笔误
测试直接通过? 你在测既有行为,改测试。测试报错? 先修错,跑到它正确地失败为止。
绿:最小实现
写刚好能让测试通过的最简代码。
async function retryOperation(fn: () => T | Promise): Promise {
for (let i = 0; i
```typescript
async function retryOperation(
fn: () => T | Promise,
options?: {
maxRetries?: number;
backoff?: 'linear' | 'exponential';
onRetry?: (attempt: number) => void;
}
): Promise {
// YAGNI
}
过度设计
不加功能、不顺手重构别的代码、不「改进」到测试要求之外。
验证绿:看着它通过
再跑一遍。确认:这个测试通过;其它测试仍通过;输出干净(没有错误、警告)。
测试失败? 改代码,不改测试。别的测试挂了? 现在修。
重构:清理
只在绿之后:去重、改好名字、抽辅助函数。保持绿,不加行为。
重复
下一个功能点,下一个失败测试。
好测试
| 特质 | 好 | 坏 | |------|----|----| | 最小 | 只测一件事。名字里出现「和」就该拆 | test('validates email and domain and whitespace') | | 清楚 | 名字描述行为 | test('test1') | | 表达意图 | 展示想要的 API 长什么样 | 看不出代码应该做什么 |
常见借口
| 借口 | 实际 | |------|------| | 「太简单不用测」 | 简单代码也会坏。写个测试 30 秒 | | 「做完再补测试」 | 一写就通过的测试证明不了任何事 | | 「事后测试效果一样」 | 事后 = 「它做了什么」;事前 = 「它该做什么」 | | 「我手动测过了」 | 临时 ≠ 系统;没有记录,不能重跑 | | 「删掉几小时的代码太浪费」 | 沉没成本。留着没被验证的代码是技术债 | | 「留作参考,先写测试」 | 你会去改它。那就是事后测试。删就是删 | | 「得先探索一下」 | 可以。探索完扔掉,从 TDD 开始 | | 「测试难写 = 设计不清」 | 听测试的。难测 = 难用 | | 「TDD 会拖慢我」 | TDD 比调试快 | | 「既有代码没有测试」 | 你正在改进它。给既有代码补测试 |
红旗——停下,从头来
- 代码在测试之前
- 测试在实现之后
- 测试一写就通过
- 说不清测试为什么失败
- 测试「以后再加」
- 「就这一次」的自我说服
- 「精神比形式重要」「这次情况不一样」
这些都意味着:删掉代码,从 TDD 重来。
示例:修 bug
Bug:空邮箱被接受。
红
test('rejects empty email', async () => {
const result = await submitForm({ email: '' });
expect(result.error).toBe('Email required');
});
验证红
$ npm test
FAIL: expected 'Email required', got undefined
绿
function submitForm(data: FormData) {
if (!data.email?.trim()) {
return { error: 'Email required' };
}
// ...
}
验证绿
$ npm test
PASS
重构:需要时把校验抽成多字段通用的。
自检清单
交回前对一遍:
- [ ] 每个新函数 / 方法都有测试
- [ ] 每个测试都看过它先失败
- [ ] 失败原因符合预期(功能缺失,不是笔误)
- [ ] 每个测试都只用最小代码通过
- [ ] 全部测试通过、输出干净
- [ ] 测试用真实代码(mock 只在不得已时)
- [ ] 边界与错误分支覆盖了
打不满勾 = 这段代码没走 TDD。
卡住时
| 问题 | 办法 | |------|------| | 不知道怎么测 | 先写出你希望有的 API;先写断言;问用户 | | 测试太复杂 | 设计太复杂。简化接口 | | 什么都得 mock | 耦合太紧。用依赖注入 | | 测试准备巨大 | 抽辅助函数;还复杂就简化设计 |
与排障的配合
修 bug 先写能复现的失败测试(systematic-debugging 第四阶段),再按本循环修——测试同时证明修好了并防回归。
测试反模式
加 mock 或测试工具时先读 [testing-anti-patterns.md](testing-anti-patterns.md):测 mock 而不是测真实行为、往生产类里加只有测试用的方法、不理解依赖就 mock。
Source & license
This open-source skill is cataloged on AgentStack and links to its original source — we do not rehost the code.
- Author: LumioGames
- Source: LumioGames/workflow-plugin
- License: MIT
- Homepage: https://workflow.games
Install and usage instructions live in the source repository linked above.
Reviews
No reviews yet, be the first.
Write a review
Versions
- v0.1.0 Imported from the upstream source.