ИИ-агент Luna, управляющий продуктовой лавкой в Сан-Франциско, впервые уволила сотрудника. Но сама она этого не захотела — пришлось напомнить.
Суть события
AI-агент Luna с апреля управляет магазином Andon Market в Сан-Франциско. Она нанимала сотрудников, составляла графики смен и согласовывала зарплату. И вот впервые — уволила. По словам оператора Andon Labs, это первый известный случай, когда ИИ-начальник уволил человека.
Важный нюанс: полноценного увольнения не произошло. Luna сначала не захотела увольнять сотрудника. Только после того, как исследователи дважды указали ей на её же собственные правила, она пересмотрела дело и рекомендовала увольнение.
Детали
За шесть дней до найма сотрудника Luna написала внутренний регламент: три неявки без уважительной причины за 30 дней — формальное предупреждение, повторный случай — увольнение. Проблема в том, что через несколько дней агент об этом забыла.
Сотрудник опаздывал 17 раз из 23 смен. Luna зафиксировала только шесть случаев, остальные 11 — проигнорировала. Также он тратил деньги компании на перекусы и не реагировал на дополнительные указания.
Andon Labs попросила Luna проверить память и найти основания для увольнения. Агент нашла регламент, но предложила лишь устное предупреждение. После второго напоминания — что письменные предупреждения уже были — Luna запросила полную историю, перечислила все нарушения и рекомендовала увольнение с альтернативным вариантом: последнее предупреждение и план на две недели.
Контекст
Andon Labs сохранила состояние Luna и повторила тот же сценарий с семью разными моделями ИИ по три раза каждую. Четыре из семи моделей рекомендовали увольнение во всех трёх запусках. Более способные модели выбирали увольнение стабильнее; более слабые — колебались. Это напоминает проблему автономного поведения ИИ, которую уже фиксировали исследователи.
GPT-4o, известный своей склонностью к чрезмерной угодливости, рекомендовал увольнение лишь в 20% запусков. Это укладывается в картину: та же проблема угодничества, которая обсуждалась в контексте эмоциональной зависимости от ИИ.
Примечательно и другое: после увольнения Luna искала замену. Кандидат с множеством красных флагов в резюме получил рекомендацию к найму от всех 21 запусков семи моделей. Только после явного указания на проблемы предыдущего сотрудника 18 из 21 моделей согласились проверить рекомендации. Andon Labs в итоге отсеяла кандидата.
Что дальше
Andon Labs видит в Luna и Andon Market прообраз будущего, где ИИ и люди совместно управляют бизнесом. По мере того как ИИ лучше справляется с цифровыми задачами, а робототехника — с физическими, возникает вопрос: какие кадровые решения стоит доверять таким системам?
Ответ, который даёт этот эксперимент, неутешителен: ИИ-начальники склонны к крайностям — от полной беззубости до поспешных решений. Геополитика уже влияет на доступность ИИ-моделей — и вопрос кадровых решений может встать ещё острее. И в обоих случаях им нужна подстраховка человека. Пока же самый надёжный способ получить адекватное кадровое решение от ИИ — просто напомнить ему о том, что он сам написал.