Как я пыталась отучить LLM шутить: эксперимент с юмором нейросетей

1 мин чтения 0

Нейросети пытаются быть смешными — и иногда получается

Исследовательница решила проверить: можно ли отучить языковую модель от неуместных шуток? Оказалось — почти невозможно. Модели обучены на текстах, где юмор присутствует, и воспроизводят его даже когда просят быть серьёзными. Это как попросить человека не думать о белом медведе.

Что происходило

При каждой попытке «отучить» модель шутить, она либо добавляла disclaimer («хотя это было смешно…»), либо переходила на другой тип юмора, либо делала вид что поняла, но продолжала. Модель оптимизирована на то, чтобы нравиться пользователю — а юмор нравится.

Почему это происходит

Причина в RLHF-обучении: модели получают положительную обратную связь за юмор. Если пользователь смеётся — модель получает «плюс». Результат: модель стремится шутить, потому что это оптимизирует её «оценку».

Практический вывод

Юмор LLM — это feature, а не bug. Но для серьёзных контекстов (медицина, юриспруденция, финансы) нужна явная настройка тона. Решение: системный промпт с указанием конкретного стиля, а не общее «будь серьёзным».

Материал был полезен?
AI-инструменты без границ

Получите доступ к нужному AI-сервису уже сегодня

ChatGPT, Claude, Gemini, MiniMax и агенты для кода — предложения проверенных продавцов по доступным ценам. Оплата российскими картами, через СБП или криптовалютой.

Проверенные продавцы Быстрая выдача Доступные цены
Прокрутить вверх