RLHF(読み)アールエルエッチエフ(英語表記)RLHF

デジタル大辞泉 「RLHF」の意味・読み・例文・類語

アール‐エル‐エッチ‐エフ【RLHF】[reinforcement learning from human feedback]

reinforcement learning from human feedback機械学習において、人間からのフィードバックを用いて強化学習をすること。また、そのような学習モデル。人間による実際評価を出力結果に反映させることで、対話型AIなどで不適切な質問を拒否するようにしたり、学習データに潜在する差別などのバイアスを除去したりする調整を行う。

出典 小学館デジタル大辞泉について 情報 | 凡例

今日のキーワード

発見学習

発見という行為の習得を目指す学習。または,発見という行為を通じて学習内容を習得することを目指す学習。発見学習への着想は多くの教育理論に認められるが,一般には,ジェローム・S.ブルーナーが『教育の過程』...

発見学習の用語解説を読む

コトバンク for iPhone

コトバンク for Android