LuAITools.com
提交工具
🔍AI
自分の失敗から学ぶ

リフレクションパターン

リフレクションは、一巡した後に自分の結果を振り返り、どこが間違っていたかを見つけ、教訓を胸にもう一度挑戦する手法。回を重ねるほど良くなります。

リフレクションパターンって何?

普通のエージェントはやり終えたらおしまい。間違っていても気づきません。リフレクション(Reflexion)はそこに「振り返り」を足します。一巡したら、モデル自身がどこが悪かったか、なぜ間違えたかを評価し、その「教訓」を書き留めて、もう一度やり直す。数回繰り返せば、品質は目に見えて上がります。

「再試行」と何が違う?

普通の再試行:同じことをもう一度
機械的にやり直すだけで、失敗から何も学ばず、同じミスを繰り返しがちです。
リフレクション:フィードバック付きで再挑戦
失敗の理由をまず文章に落とし、次のプロンプトに織り込みます。つまり「前回どこで間違えたか」を覚えた状態で再挑戦します。

どう動くのか

第一歩:実行して結果を出す
エージェントが普通にタスクをこなし、結果を得ます。
第二歩:自己評価
別の「評価者」かモデル自身が結果を検証します。何が間違いか、なぜか、どう直すか。
第三歩:振り返りを携えて再実行
振り返りの結論を新しい文脈として渡し、合格するまでエージェントがやり直します。

なぜ重要なのか

コードを書く、数学を解く、複雑な文章を作る——一回で正解するのが難しいタスクは多い。リフレクションはエージェントに「失敗から学ぶ力」を与え、人がいなくても自分で直して安定させられます。

まとめ:リフレクションはエージェントに「やり終えたら振り返る」をさせ、失敗を経験に変えて再挑戦させる手法です。

コメント