
BlueDot Narrated
Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback
32 min•4 januari 2025
Om avsnittet
Audio versions of blogs and papers from BlueDot courses.
This paper explains Anthropic’s constitutional AI approach, which is largely an extension on RLHF but with AIs replacing human demonstrators and human evaluators.
A podcast by BlueDot Impact.
Fler avsnitt
Visa alla avsnitt av BlueDot NarratedBlueDot Narrated med BlueDot Impact finns tillgänglig på flera plattformar. Informationen på denna sida kommer från offentliga podd-flöden.