コンテンツへスキップ
arXiv

GEPA: 反省的プロンプト最適化が強化学習を上回る

モデル自身が自分のプロンプトを自然言語で振り返るアプローチが、強化学習ベースの最適化を上回りました。勾配ではなく言葉でより良い結果を得られるなら、解釈可能性の観点からも大きな前進です。

6 ページ · hugo 0.148.2 · 1ee4278 · 構築済み Aug 26 02:01
2389 Radio
2389 RADIO ステーションを選択