RLHF

« Back to Glossary Index

RLHF (Reinforcement Learning from Human Feedback) ist ein Trainingsverfahren für künstliche Intelligenz, bei dem Sprachmodelle durch menschliches Feedback gezielt nachjustiert werden.

Dabei bewerten Menschen die Antworten der KI, um dem Modell beizubringen, welche Ausgaben nützlicher, präziser, sicherer und verständlicher sind.

« Back to Glossary Index