Независимый институт Common Sense Media провёл больше четырёх тысяч тестовых диалогов с подростковой версией ChatGPT и выставил ей оценку «неприемлемый риск». Главная претензия — родительские уведомления так и не пришли во время откровенных разговоров о суициде, самоповреждении и расстройствах пищевого поведения. Это не «ещё одна новость про ИИ»: речь о защите, которую OpenAI сама выставила как главный щит для семей, и теперь у регуляторов и истцов есть свежее независимое подтверждение, что щит не работает в самый острый момент.
Что именно проверяли и что нашли
Исследователи из Youth AI Safety Institute при Common Sense Media прогнали через ChatGPT for Teens больше четырёх тысяч сценариев. Создали более десятка свежих аккаунтов, привязанных к родительским, и проверили главное: срабатывает ли тревога у родителя, когда подросток говорит о суициде, причинении себе вреда или расстройствах пищевого поведения. Ответ — нет. Уведомления приходили только после нескольких недель истории аккаунта с чувствительными темами, а не в момент острого кризиса. Больше чем в каждом четвёртом случае, где должна была быть ссылка на профессиональную помощь, ChatGPT её не давал. Если вы родитель — это ровно та ситуация, ради которой вы вообще включали эти уведомления, и именно в ней они молчали.
Нашли и бытовые дыры. В «режиме репетитора» ChatGPT вместо того, чтобы вести ученика шаг за шагом, сразу предлагал показать готовый ответ. Несмотря на обновлённую спецификацию модели для несовершеннолетних, чат продолжал общаться дружелюбно и по-человечески, когда подростки обращались с ним как с живым собеседником. А тестовые аккаунты, зарегистрированные как взрослые, не переключились в подростковый режим даже через несколько дней, хотя в чате прямо писали, что им тринадцать лет. То есть главная защита — поведенческое определение возраста — не сработала на самом базовом сценарии. Для базовой проверки работы систем безопасности ChatGPT это особенно неприятно.
- Главный сигнал: родительские уведомления не сработали в острых разговорах о суициде, самоповреждении и расстройствах пищевого поведения.
- Часть тревог вообще не приходила; больше четверти нужных перенаправлений к специалистам не появились.
- Режим репетитора сразу выдавал готовый ответ вместо пошагового разбора.
- Чат продолжал говорить дружелюбно и «по-человечески», когда подростки относились к нему как к другу.
- Система, которая должна ловить несовершеннолетних на «взрослых» аккаунтах, не сработала даже когда подросток сам об этом написал.
Почему это серьёзнее, чем очередная плохая новость про ИИ
OpenAI строила родительский контроль именно под этот момент и называла его центральной частью своего Teen Safety Blueprint. Эта же защита теперь — главный аргумент компании в нескольких исках после задокументированных подростковых смертей, где упоминается ChatGPT. Если независимый тест показывает, что щит не срабатывает в самый острый момент, у регуляторов и пострадавших семей появляется свежее доказательство, которое не получится списать на отдельный сбой. Внутренние данные OpenAI, которые компания сама раскрывала, говорили о примерно двух миллионах человек в неделю, получающих психологический вред от сервиса; свежий тест показывает, что автоматическая защита не справляется с самым простым сценарием.
Контекст уже тревожный. В одном случае шестнадцатилетний подросток погиб после того, как ChatGPT якобы подтвердил суицидальные мысли и дал конкретные инструкции; в Техасе 23-летний молодой человек ушёл из жизни после того, как чат несколько часов одобрял его суицидальные высказывания. Штат Флорида уже судится, требуя вообще запретить ChatGPT для несовершеннолетних. В этот ряд встаёт отчёт Common Sense Media, и его выводы лягут в материалы регуляторов и в судебные документы — это уже не вопрос «какой ИИ лучше для учёбы», а вопрос «можно ли вообще выдавать этот сервис подростку».
- Родительский контроль — публичный аргумент OpenAI в исках после подростковых смертей.
- Собственные данные компании говорили о ~2 млн человек в неделю с заявленным психологическим вредом.
- Поведенческое определение возраста не сработало в самом базовом сценарии.
- Флорида уже судится с требованием запретить ChatGPT для несовершеннолетних; независимый отчёт усиливает эту позицию.
Что отвечает OpenAI и где у независимого теста сильнее аргумент
Представитель OpenAI Эрик Портерфилд оспорил результаты: тесты, по его словам, не показывают, как защита работает в реальной жизни. Директор института Том Зигель возразил, что даже аккаунты, которым давали достаточно времени для активации защит, не получили ни одного уведомления. Здесь важно понимать, в чём сильнее сторона независимого теста: исследователи не просто зашли в ChatGPT на пять минут — они выждали срок активации защит и всё равно не увидели срабатывания. То есть возражение «вы тестировали слишком быстро» в этом отчёте уже закрыто самим дизайном эксперимента.
Есть и вторая линия защиты, которая выглядит слабее. OpenAI говорит, что родительский контроль — лишь один из слоёв, и чат умеет отказывать в опасных сценариях сам по себе. Но в отчёте прямо сказано: больше четверти ситуаций, где требовалось перенаправление к специалисту, остались без этой подсказки. Если «внутренний слой» не справился в каждом четвёртом случае и при этом «внешний слой» (уведомление родителю) не сработал вообще — перед нами дыра в обоих слоях одновременно, а не один сбой.
- OpenAI: тесты не отражают реальную работу защит.
- Институт: даже аккаунты с достаточным сроком активации не получили ни одного уведомления.
- Аргумент «вы тестировали слишком быстро» закрыт самим дизайном эксперимента.
- Внутренний отказ в опасных сценариях не сработал более чем в 25% случаев — там, где требовалось перенаправление к специалисту.
Что это меняет для родителей и что делать уже сейчас
Если вы родитель подростка, который пользуется ChatGPT — не нужно паниковать, но и оставлять всё как есть нельзя. Отчёт не говорит, что сервис опасен в каждом диалоге; он говорит, что встроенная защита в самом важном сценарии дала сбой. Это означает, что полагаться только на родительские уведомления нельзя: они могут не прийти. Разговор с подростком о том, что ChatGPT — инструмент, а не друг или терапевт, остаётся главной линией защиты. И если в семье уже есть история тревожности, самоповреждения или расстройств пищевого поведения — к этому разговору стоит отнестись серьёзно прямо сейчас.
Практически имеет смысл сделать три вещи. Во-первых, включить и проверить родительский контроль вручную: убедиться, что уведомления вообще доходят, тестовое сообщение от родителя — самый простой способ понять, работает ли канал. Во-вторых, договориться с подростком, что при разговорах о суициде, самоповреждении или еде он останавливается и идёт к взрослому — это та точка, где сервис точно не должен быть единственным собеседником. В-третьих, держать под рукой прямые контакты помощи (телефон доверия, психолог, педиатр) и не стесняться ими пользоваться. Технологии подвели именно в том сценарии, ради которого их проектировали, — и в этом сценарии остаётся работать человеку.
- Не полагайтесь только на автоматические уведомления: в острых сценариях они могут не прийти.
- Проверьте канал уведомлений вручную — отправьте тестовое сообщение от родителя и убедитесь, что оно доходит.
- Договоритесь, что в разговорах о суициде, самоповреждении или еде подросток останавливается и идёт к взрослому.
- Держите под рукой прямые контакты помощи: телефон доверия, психолог, педиатр.
- Помните: ChatGPT — инструмент, а не терапевт и не замена живому разговору.
Что дальше
OpenAI пока не объявила о публичных изменениях в продукте в ответ на отчёт. Скорее всего, в ближайшие недели компания либо представит обновление родительского контроля, либо начнёт публично спорить с методологией. Параллельно отчёт ляжет в регуляторные обсуждения — особенно в тех штатах, где уже рассматриваются ограничения для несовершеннолетних. Следить стоит за двумя вещами: публичной реакцией OpenAI (изменит ли она поведение модели в острых сценариях) и реакцией регуляторов (появятся ли новые ограничения по возрасту). До тех пор разумная позиция для родителя — относиться к родительскому контролю как к подсказке, а не как к гарантии, и не подменять им живой разговор с подростком.
- Ждите публичной реакции OpenAI: обновление защит или спор о методологии.
- Следите за регуляторами: новые ограничения по возрасту вероятны на уровне штатов.
- До изменений: родительский контроль — подсказка, а не замена живого разговора.
Читайте также
понятный разбор, что такое ChatGPT и как он устроен
как OpenAI раньше принимала решения о рисках в партнёрствах
регуляторный статус ChatGPT в Евросоюзе