このタグが付いた用語の一覧です。
2 語
IN-TAG SEARCH
検索ボックスを準備中…
検索機能を使うには JavaScript を有効にしてください。
RLHF(人間のフィードバックによる強化学習)
人の「良し悪し」の評価を手本にして、AIの答え方を好まれる方向へ整える学習法です。
強化学習
うまくいくと「ごほうび」がもらえるしくみで、試行錯誤しながらコツを学ぶ機械学習の方法です。
よく使われているタグ