リフレクションパターンって何?
普通のエージェントはやり終えたらおしまい。間違っていても気づきません。リフレクション(Reflexion)はそこに「振り返り」を足します。一巡したら、モデル自身がどこが悪かったか、なぜ間違えたかを評価し、その「教訓」を書き留めて、もう一度やり直す。数回繰り返せば、品質は目に見えて上がります。「再試行」と何が違う?
普通の再試行:同じことをもう一度機械的にやり直すだけで、失敗から何も学ばず、同じミスを繰り返しがちです。
リフレクション:フィードバック付きで再挑戦
失敗の理由をまず文章に落とし、次のプロンプトに織り込みます。つまり「前回どこで間違えたか」を覚えた状態で再挑戦します。
どう動くのか
第一歩:実行して結果を出すエージェントが普通にタスクをこなし、結果を得ます。
第二歩:自己評価
別の「評価者」かモデル自身が結果を検証します。何が間違いか、なぜか、どう直すか。
第三歩:振り返りを携えて再実行
振り返りの結論を新しい文脈として渡し、合格するまでエージェントがやり直します。
なぜ重要なのか
コードを書く、数学を解く、複雑な文章を作る——一回で正解するのが難しいタスクは多い。リフレクションはエージェントに「失敗から学ぶ力」を与え、人がいなくても自分で直して安定させられます。まとめ:リフレクションはエージェントに「やり終えたら振り返る」をさせ、失敗を経験に変えて再挑戦させる手法です。
コメント