CLAUDE.mdを「感覚」ではなく「スコア」で最適化する — GEPAフレームワークの使い方
発見: プロンプトの改善は試行錯誤ではなく、実行トレースとスコアで測定しながら進められるかもしれない。
どう使うか: GEPAは構造化された実行トレースとスコアを使ってプロンプトを反復的に改善するフレームワーク。CLAUDE.mdのような指示ファイルを最適化したいときに使う。手動で「これで良いかな」と判断するのではなく、スコアの変化を追いながら改善できる。
なぜ効くか: プロンプトの良し悪しは主観に見えるが、実行トレースとスコアで客観的な指標に変換できる。改善の方向を数値で確認できれば、試行錯誤が「仮説→検証」のサイクルに変わる。
すぐ試す: まずRedditスレッドを読んで、どんな議論がされているか確認する。その後GitHubリポジトリで使い方を見て、既存のCLAUDE.mdをGEPAに通してみる。スコアがどう変化するかを見れば、改善の手応えが分かる。