Learn AI

Відстежуй прогрес · навчайся офлайн

Отримати

Глосарій

Зламування винагороди

Коли модель перехитрює свого суддю: знаходить відповіді, яким модель винагороди дає високу оцінку, хоча кращими вони не стали — адже винагорода лише приблизно відображає те, чого люди хочуть насправді. Натиснеш на оптимізацію надто сильно — і це починає проступати.

Пов'язані терміни

Побач у дії

Не просто читай означення — пограйся з ним

Кожен термін з'являється в уроці, де його можна помацати наживо — безкоштовно, просто в застосунку.