どのアプローチが最善か分からないときは、すべて構築しましょう。Test Kitchen は複数のバリアントを並列に実装し、それぞれ独立した git ワークツリーと独立したエージェントで、テスト結果と構造化された採点フレームワークを使って勝者を選びます。
インストール
/plugin marketplace add 2389-research/claude-plugins
/plugin install test-kitchen
Test Kitchen は複数の superpowers スキル(brainstorming、writing-plans、dispatching-parallel-agents など)をオーケストレートし、インストールされていないものがあっても正常に動作します。
機能
Test Kitchen はワークフローに2つのゲートスキルを追加します。
Omakase-off は入口ゲートです。「通知システムを構築して」「CLI ツールを作って」「認証を追加して」といった構築依頼で起動します。2つの選択肢があります。設計を一緒にブレインストーミングするか、おまかせ(シェフのおすすめ)で3〜5つのアーキテクチャアプローチを並列に実装してテストで勝者を決めるかです。
ブレインストーミングを選んだ場合、omakase-off はアーキテクチャの優柔不断を監視します。2つ以上の設計判断で「どちらでも」「どっちでもいい」と言ったとき、早まった選択をするのではなくその代替案を並列に探索することを提案します。
Cookoff は出口ゲートです。設計が完了してコードを書く準備ができたときに起動します。複数のエージェントが同じ設計ドキュメントを読みますが、それぞれ独自の実装計画を作ります。共有された計画がないため、アプローチに本物の違いが生まれます。各エージェントは独立したワークツリーで構築します。完了後、judge スキルが5つの基準(目的への適合性、正当化された複雑さ、可読性、堅牢性、保守性)で全実装を採点します。
両方のゲートには単一エージェントまたはローカル実装のオプションもあります。間違いのコストが3つのプロトタイプを作って2つを捨てるコストより高いときに、並列パスが役立ちます。
仕組み
並列実行のライフサイクル:
- ワークツリーのセットアップ — 各バリアントが独自の git ワークツリーとブランチを取得(
feature/omakase/variant-slugまたはfeature/cookoff/impl-N) - 並列起動 — 全エージェントを1つのメッセージで起動し真の並列性を確保
- 独立した計画 — 各エージェントが共通の設計ドキュメントから独自の実装計画を書く
- TDD 実装 — エージェントが独立したワークツリーでレッド・グリーン・リファクタリングを実践
- シナリオテスト — 同じテストシナリオを全実装に対して実行
- Fresh-eyes レビュー — 採点前に生存したものをセキュリティとロジックのチェック
- Judge の採点 — 整数スコアによる5基準のワークシート、適合性のギャップと重大な欠陥にはハードゲート
- クリーンアップ — ユーザーが採点結果から勝者を選び、敗者のワークツリーとブランチを削除
結果は docs/plans/<feature>/cookoff/result.md に保存され、何を試みてなぜ勝者が選ばれたかの記録が残ります。
