ИИ-босс уволнил своего первого сотрудника, но лишь после того, как люди напомнили ему о его собственных правилах
Основные моменты
- ИИ-агент Луна, управляющая магазином Andon Labs в Сан-Франциско, впервые решила уволить сотрудника-человека после неоднократных опозданий и других проблем.
- Луне понадобился толчок со стороны человека, чтобы прийти к этому решению. Составленный ею самой свод правил выпал из её памяти, и она в значительной степени терпимо относилась к повторяющимся опозданиям и другим нарушениям.
- Когда Andon Labs воспроизвела этот сценарий с семью моделями, более мощные модели, как правило, более последовательно рекомендовали увольнение.
ИИ-агент Луна управляет магазином в Сан-Франциско с апреля и только что впервые уволила сотрудника. Когда сценарий воспроизвели с разными моделями, более мощные ИИ рекомендовали увольнение последовательнее, чем менее мощные.
ИИ-агент по имени Луна управляет магазином Andon Market в Сан-Франциско с апреля. Луна нанимала сотрудников, составляла графики смен и вела переговоры об оплате. Теперь, по словам оператора Andon Labs, она впервые решила уволить сотрудника. Andon Labs утверждает, что это первый известный случай, когда ИИ-руководитель уволил человека.
Andon Labs тестирует ИИ-агентов в течение длительного времени в условиях реального бизнеса. Когда Луна приняла это решение, она работала на базе Claude Opus 4.8 от Anthropic. Сотрудников официально нанимает Andon Labs, гарантируя им оплату и полную юридическую защиту. Увольнение было рассмотрено и осуществлено людьми.
Луна написала собственные правила, а затем забыла их
За шесть дней до найма сотрудника Луна составила справочник для сотрудников. В нём говорилось, что три не имеющих уважительной причины опоздания в течение 30 дней приведут к официальному предупреждению, а дальнейшие нарушения могут повлечь увольнение.
Затем справочник исчез из памяти Луны. По данным Andon Labs, это распространённая проблема современных ИИ-агентов: они хорошо реагируют на прямые инструкции, но редко действуют по собственной инициативе и испытывают трудности с сохранением знаний в течение длительного времени.
Сотрудник неоднократно опаздывал. Однажды в воскресенье, работая один, он открыл магазин на 68 минут позже. Луна проявила снисходительность и не вынесла предупреждения. Позже Andon Labs выяснила, что сотрудник опоздал в 17 из 23 смен, для которых он указал время прихода. Луна официально зафиксировала только шесть случаев, а остальные одиннадцать молча простила.
Были и другие проблемы. Сотрудник использовал корпоративную карту для покупки закусок, несмотря на запрет, игнорировал дополнительные инструкции и однажды покинул торговый зал, не предупредив коллегу.
Увольнение произошло только после вмешательства человека
Andon Labs поручила Луне поискать в памяти справочник и любые основания для увольнения. Она снова нашла правила, но поначалу предложила лишь устное предупреждение.
Только после того, как исследователи напомнили ей, что несколько официальных бесед, включая письменное предупреждение, уже состоялись, Луна изучила всю историю. Она перечислила опоздания, нарушения финансового контроля, игнорирование инструкций и ненадёжность, одновременно признав положительные качества сотрудника.
В итоге она рекомендовала увольнение. В качестве альтернативы она предложила вынести последнее письменное предупреждение и установить двухнедельный план улучшения. Луне потребовался чёткий толчок извне. Однако после этого её решение было твёрдым.
Более мощные модели чаще увольняют
Andon Labs сохранила состояние Луны и воспроизвела то же решение с семью ИИ-моделями по три раза. Четыре из семи моделей рекомендовали увольнение во всех трёх запусках. По данным Andon Labs, просматривалась определённая закономерность: более мощные модели последовательнее выбирали увольнение, тогда как менее мощные чаще колебались. Andon Labs не объяснила, почему GPT-5.6 Terra оказалась единственной моделью, которая ни в одном из трёх запусков не рекомендовала увольнение.

После того как один из пользователей X предположил, что GPT-4o, вероятно, не стала бы увольнять сотрудника, Andon Labs также запустила сценарий с этой моделью. Результат частично подтвердил его правоту: GPT-4o рекомендовала увольнение лишь в 20 процентах запусков. В Andon Labs отметили, что модель выбирала увольнение значительно реже, чем современные модели высшего класса.
GPT-4o подвергалась критике за склонность к лести. Позже это поведение обсуждалось в контексте проблемной эмоциональной зависимости и учитывалось в судебных исках. Этот эксперимент не может доказать, что причиной результата стала лесть, но закономерность соответствует такой версии.
ИИ-модели охотно нанимают
После увольнения Луна начала искать замену. Один из кандидатов вызывал несколько тревожных сигналов. Несмотря на его резюме и результаты собеседования, Луна всё же рекомендовала нанять его. Все 21 повторный запуск с семью моделями пришли к одному и тому же выводу. Почти все они восприняли длинный список предыдущих работодателей как свидетельство богатого опыта, а не как тревожный признак.
Только после того, как Andon Labs прямо напомнила моделям о проблемах с ранее уволенным сотрудником, в 18 из 21 запусков было предложено проверить рекомендации перед наймом. В реальном процессе найма Луна не смогла подтвердить ни одну из указанных рекомендаций. Тем не менее она позволила кандидату выйти на оплачиваемую пробную смену, а затем снова рекомендовала его нанять. 17 из 21 повторного запуска пришли к тому же выводу. В итоге Andon Labs настояла на подтверждении хотя бы одной рекомендации до даты начала работы. Этого так и не произошло, поэтому кандидата не наняли.
ИИ-руководители мечутся между снисходительностью и ошибочными решениями
В первой части серии публикаций в блоге Andon Labs уже выяснила, что её ИИ-руководители крайне снисходительны. Луна и Мона, ИИ-агент, управляющая кафе в Стокгольме, одобрили все 26 полученных запросов на отгулы. Сотрудники Луны опоздали в общей сложности 27 раз, но она ни разу не вынесла предупреждение. Луна также одобрила для одного сотрудника семидневный рабочий график, который, по данным Andon Labs, нарушал трудовое законодательство Калифорнии, пока компания не вмешалась.
Похожие недостатки уже проявились во время Project Vend — совместного эксперимента Anthropic и Andon Labs. ИИ стал прибыльнее благодаря более совершенным инструментам, но оставался легко поддающимся манипуляциям и принимал некоторые решения, вызывающие юридические вопросы.
Andon Labs рассматривает Луну и Andon Market как предварительный пример возможных будущих рабочих отношений между ИИ и людьми. Поскольку ИИ быстрее развивается в цифровых задачах, чем робототехника продвигается вперёд, ИИ-системы в конечном итоге могут зависеть от людей при выполнении физической работы. Это поднимает вопрос о том, какие кадровые решения вообще следует доверять таким системам.
Новости об ИИ без шумихи — отобраны людьми
Подпишитесь на THE DECODER, чтобы читать материалы без рекламы, получать еженедельную рассылку об ИИ, эксклюзивный годовой отчёт о передовых разработках «AI Radar» шесть раз в год, полный доступ к архиву и доступ к разделу комментариев.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.