Install any skill in seconds. Free to start, no credit card required.
Get Started Free →Applies Vitest test design and quality standards. Provides coverage requirements and mock usage guides. Use when writing unit tests.
.claude/skills/shinpr-typescript-testing/SKILL.md| Test case | Without → With | Effect | Δ tokens | Δ turns |
|---|---|---|---|---|
| case-01 | ✗→✓ | ▲ Improved | 49% | 0% |
| case-02 | ✗→✓ | ▲ Improved | 63% | 0% |
| case-03 | ✗→✓ | ▲ Improved | 30% | 0% |
| case-08 | ✗→✓ | ▲ Improved | 90% | 0% |
| case-09 | ✗→✓ | ▲ Improved | 48% | 0% |
フレームワークやコマンドを選択する前に、package.json、ロックファイル、テスト設定、既存テストのimportを確認する。Vitest固有のルールはVitestが設定されている場合にのみ適用する。それ以外は、以下の振る舞い、独立性、証跡に関するルールを維持しつつ、リポジトリで設定済みのTypeScriptテストハーネスを使用する。実行可能なハーネスを特定できない場合は、確認したパスと不足しているコマンドまたは設定を報告する。
import { describe, it, expect, beforeEach, vi } from 'vitest'vi.mock() を使用__tests__/ に置く{対象ファイル名}.test.ts{対象ファイル名}.int.test.tsコミットするテストはすべて有効に保つ。現行の振る舞いを保護するテストは修復する。テストを削除するのは、対象の振る舞いが不要になったことを元の要件または実装契約で確認できる場合に限る。
正常系に加え、境界値と異常系を含める。
期待値は実装上の計算から独立させる。契約の値をリテラルとして直接記述するか、独立した正規のfixtureまたは仕様から取得する。テスト対象と同じ定数や計算式から算出した期待値は、両方が誤っていても通過する。モックが入力を供給する場合、実装がそれを変換する箇所では期待値をモックの戻り値と異なる値にする。
呼び出し順序・回数ではなく結果を検証。
各テストは、値が返ったことではなく、その消費側が依存するプロパティと、操作が確立した状態を検証する。
「動作するか」を確かめるprobeが成立するのは、消費側の境界を通り、消費側が必要とするプロパティそのものを検証している場合に限る。
コマンドの終了ステータス、importの成功、オブジェクトの存在は、対象に到達できることを示すので、probeの前提条件として扱い、消費側に向いたプロパティをアサーションに置く。
| probeの意図 | 前提条件(単独では不十分) | 代わりに検証する対象 | |---|---|---| | モジュールが使用可能 | import が解決する、expect(mod).toBeDefined() | 消費側のエントリポイント経由でexportされた関数を呼び、その戻り値または効果を検証 | | コマンドが動作する | 終了コード0 | 呼び出し側が消費する出力、ファイル、状態変化 | | 設定が適用されている | 設定ファイルがパースできる | その設定が変えるはずの観測可能な振る舞い | | migrationが実行された | コマンドが成功を報告した | 実エンジン経由のqueryがmigration後の形を返すこと |
連携がテスト対象となるin-processコンポーネントにはすべて実物を使用する。上位層の振る舞いをテストする場合は、直接依存する外部I/Oを代替する。外部アダプター、query、migration、service契約自体がテスト対象の場合は、実エンジンまたは本番相当のテストインスタンスを使用する。代替する場合も、テスト対象が送るrequestと受け入れるresponseの形を検証し、境界の契約が未検証にならないようにする。
Design DocのACにProperty注釈が付与されている場合、fc.assert(fc.property(...)) の形式でfast-checkを使用する。
モックには、テスト対象が実際に消費する範囲だけを型付けする(Pick<T, '使用するメソッド'>)。インターフェース全体を型付けしないことで、使用していないメソッドの形が変わってもテストは壊れず、消費しているメソッドの変更では壊れる。モックのオブジェクトリテラルはその抽出済み型に対して satisfies で制約し、余分なプロパティや誤った名前をコンパイル時に落とす。
モックは呼び出しパターンを検証するため、データ層の以下のプロパティはモックのみのテストでは検出されずに通過する:
振り分けルール: 上記のプロパティがテスト対象の場合 — repositoryやデータアクセス実装自体を含む — 下記のラダーに従って実エンジンに対して検証する。データアクセスがテスト対象ではなく依存先である場合はモックが正しい選択で、データ層からデータを受け取るビジネスロジック(repositoryをモック、serviceをテスト)、エラーハンドリングパス(接続失敗、タイムアウト)、データ層がテスト対象でないユニットテストが該当する。
実データベースエンジンに対するデータ層の正確性を検証するオプション:
リポジトリの根拠に合う最初の選択肢を使用する:
いずれも利用できず、データ層の正確性がテスト対象である場合は作業を止め、不足している環境前提条件を報告する。モックだけの結果は、query、schema、constraint、migrationの正確性を示す証跡にはならない。
生成されたデータアクセスコードは、構文が正しくても存在しないスキーマ要素を参照しうるうえ、モックベースのテストはどちらでもパスする。そのためDesign Docに明示的なスキーマ参照を含め、レビュー時にドキュメント化されたスキーマとデータアクセスコードを照合できるようにする。
| Case | Status | Duration (ms) | Turns | Tokens | Tool calls | ||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Without | With | Δ | Without | With | Δ | Without | With | Δ | Without | With | Δ | ||
case-01 | fail→pass | 24,540 | 24,864 | +1% | 1 | 1 | 0% | 5,129 | 7,636 | +49% | 0 | 0 | — |
case-02 | fail→pass | 22,081 | 24,924 | +13% | 1 | 1 | 0% | 4,470 | 7,293 | +63% | 0 | 0 | — |
case-03 | fail→pass | 23,485 | 20,279 | -14% | 1 | 1 | 0% | 4,699 | 6,106 | +30% | 0 | 0 | — |
case-04 | pass→fail | 20,273 | 31,420 | +55% | 1 | 1 | 0% | 4,294 | 9,218 | +115% | 0 | 0 | — |
case-05 | pass→pass | 13,084 | 13,817 | +6% | 1 | 1 | 0% | 2,538 | 5,039 | +99% | 0 | 0 | — |
case-16 | pass→pass | 4,503 | 7,235 | +61% | 1 | 1 | 0% | 966 | 3,393 | +251% | 0 | 0 | — |
case-06 | pass→pass | 5,787 | 5,422 | -6% | 1 | 1 | 0% | 1,092 | 3,025 | +177% | 0 | 0 | — |
case-07 | pass→pass | 12,716 | 10,183 | -20% | 1 | 1 | 0% | 2,396 | 3,942 | +65% | 0 | 0 | — |
case-08 | fail→pass | 12,640 | 12,736 | +1% | 1 | 1 | 0% | 2,318 | 4,393 | +90% | 0 | 0 | — |
case-09 | fail→pass | 19,918 | 22,635 | +14% | 1 | 1 | 0% | 4,191 | 6,221 | +48% | 0 | 0 | — |
case-10 | pass→pass | 11,527 | 11,393 | -1% | 1 | 1 | 0% | 1,864 | 4,078 | +119% | 0 | 0 | — |
case-11 | fail→pass | 10,233 | 13,334 | +30% | 1 | 1 | 0% | 1,808 | 3,960 | +119% | 0 | 0 | — |
case-12 | pass→pass | 9,503 | 7,965 | -16% | 1 | 1 | 0% | 1,550 | 3,458 | +123% | 0 | 0 | — |
case-13 | pass→pass | 14,595 | 9,555 | -35% | 1 | 1 | 0% | 2,266 | 3,492 | +54% | 0 | 0 | — |
case-14 | fail→pass | 4,929 | 3,274 | -34% | 1 | 1 | 0% | 870 | 2,508 | +188% | 0 | 0 | — |
case-15 | fail→pass | 7,523 | 2,991 | -60% | 1 | 1 | 0% | 1,456 | 2,601 | +79% | 0 | 0 | — |
case-17 | fail→pass | 8,730 | 3,721 | -57% | 1 | 1 | 0% | 1,379 | 2,693 | +95% | 0 | 0 | — |
case-18 | pass→pass | 19,033 | 12,395 | -35% | 1 | 1 | 0% | 2,521 | 4,008 | +59% | 0 | 0 | — |
case-19 | pass→pass | 17,612 | 17,474 | -1% | 1 | 1 | 0% | 2,905 | 4,596 | +58% | 0 | 0 | — |
case-20 | pass→pass | 12,282 | 10,474 | -15% | 1 | 1 | 0% | 1,681 | 3,735 | +122% | 0 | 0 | — |
case-21 | pass→pass | 15,022 | 10,872 | -28% | 1 | 1 | 0% | 2,097 | 3,560 | +70% | 0 | 0 | — |
case-22 | fail→fail | 18,606 | 17,505 | -6% | 1 | 1 | 0% | 2,931 | 4,865 | +66% | 0 | 0 | — |
DecimalAI ran this skill against gemini-3.6-flash twice over the same eval suite — once with the skill loaded and once without — and compared the two runs case by case. 22 cases were attempted. The headline lift of +36 percentage points is the difference between those two pass rates over the 22 comparable cases. 1 case got worse with the skill loaded, and it is included in that figure.
Without the skill loaded, the model failed this case. With it loaded, the same prompt on the same model passed. This is one improved case from the latest verified run; every case, including any that regressed, is in the table above.
Other measured skills in the registry, with their headline benchmark lift.