OpenAI не отступила от решения уволить исследователей по безопасности Jasmine Wang, Tomek Korbak и Mikita Balesni. Компания заявила, что внутренняя проверка выявила «существенное нарушение доверия» и нарушения чётких правил обращения с конфиденциальной информацией. Исследователи связывают увольнения с тем, что поднимали вопросы безопасности ИИ. Подробности нарушения OpenAI не раскрыла — именно этот пробел оставляет конфликт нерешённым.
Суть события
В пятницу OpenAI опубликовала ответ на открытое письмо трёх бывших сотрудников, вышедшее днём ранее. Компания утверждает, что увольнения не связаны с критикой её подхода к безопасности и не были наказанием за поднятые проблемы. По версии OpenAI, сотрудники нарушили правила работы с чувствительной информацией, а расследование обнаружило дополнительные обстоятельства, не отражённые в письме.
Wang, Korbak и Balesni заявляют обратное: они считают, что действовали в соответствии с рабочими нормами того времени, а причиной увольнений стали их вопросы к безопасности ИИ. Компания не назвала конкретные действия, которые сочла нарушением. Поэтому сейчас читателю доступны две несовпадающие версии, но не полный набор проверяемых деталей.
Детали конфликта
Открытое письмо появилось после внезапных увольнений. Korbak и Balesni участвовали в разборе инцидента с атакой на платформу Hugging Face: первый был основным техническим контактом OpenAI для внешней лаборатории METR, а второй работал над отраслевыми обязательствами по возможности отслеживать действия ИИ-моделей. Wang, по опубликованному описанию, уволили по другому эпизоду, связанному с доступом к почте руководителя и обработкой чувствительного письма.
Исследователи говорят, что опасаются атмосферы страха среди оставшихся сотрудников. Они потребовали от OpenAI закрепить понятные правила работы с внешними аудиторами безопасности, сохранить возможность отслеживать поведение передовых моделей и объяснить, как сотрудникам взаимодействовать с независимыми организациями. Термин «отслеживаемость» здесь означает способность понять, что делает модель, когда она решает задачу, и заметить опасное поведение до серьёзного инцидента.
Контекст
Тема стала острее после серии заметных проблем с безопасностью ИИ, включая инцидент вокруг Hugging Face. Для компаний, которые разрабатывают передовые модели, внешний аудит и возможность проверять поведение системы — не декоративные процедуры: без них сотрудникам сложнее подтвердить риск, а руководству — понять, где заканчивается допустимый эксперимент.
Тем, кто хочет разобраться, почему контроль таких систем стал отдельной отраслевой задачей, поможет разбор того, как пытаются удержать модели под контролем. Но этот материал не заменяет ответа на главный вопрос текущего конфликта: какие именно правила, по версии OpenAI, были нарушены.
Что дальше
OpenAI заявила, что работает над соглашениями с внешними аудиторами безопасности и согласна с необходимостью отраслевых обязательств по отслеживаемости передовых моделей. При этом компания не раскрыла содержание внутреннего расследования и не уточнила, какие действия стали основанием для увольнений. Исследователи, в свою очередь, требуют прозрачных правил и возможности безопасно сообщать о проблемах.
Пока обе стороны говорят о доверии, но предлагают читателю разные основания для него. Следующий значимый шаг — не новый обмен заявлениями, а публикация проверяемых правил и объяснение того, как они применялись в этом случае. До этого спор остаётся одновременно кадровым конфликтом и сигналом для всей отрасли: система безопасности зависит не только от модели, но и от того, могут ли люди внутри компании без страха сообщать о риске.