Sveriges mest populära poddar
BlueDot Narrated

Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback

32 min4 januari 2025

Audio versions of blogs and papers from BlueDot courses. 


This paper explains Anthropic’s constitutional AI approach, which is largely an extension on RLHF but with AIs replacing human demonstrators and human evaluators.

A podcast by BlueDot Impact.

BlueDot Narrated med BlueDot Impact finns tillgänglig på flera plattformar. Informationen på denna sida kommer från offentliga podd-flöden.