A GDM Alignment paper finds that adding a debate opponent during RL training cuts down on LLM judges getting fooled into over-rewarding.
Continue to AI University →