Claude:RLHF
from Claude:Glossary
RLHF(人間フィードバック強化学習)
人間の評価者がAIの出力に点数をつけ、その結果をもとにモデルを改善する学習手法の略称。Claudeの応答品質・安全性・有用性を高める重要なトレーニングプロセスの一つです。