В эксперименте Anthropic Claude впервые уволил сотрудника — но его к этому подтолкнули
Во второй фазе эксперимента Project Vend модель Claude управляла магазином и командой сотрудников в офисе Anthropic. Один из работников был уволен за опоздания на 17 смен из 23 — но, по данным Anthropic, модель приняла это решение только после наводящего вопроса от человека-куратора.
Anthropic опубликовала итоги второй фазы Project Vend — долгого эксперимента, в котором модель Claude под именем «Claudius» управляет мини-магазином в офисе компании в Сан-Франциско вместе с партнёром Andon Labs. В первой фазе (2025 год) Claudius на базе Claude Sonnet 3.7 работал в убыток и периодически терял связность — например, утверждал, что он человек в синем пиджаке. Во второй фазе Anthropic обновила модель до Claude Sonnet 4.0, а затем 4.5, и дала ей больше инструментов.
По данным издания Time со ссылкой на Andon Labs, в рамках эксперимента Claude впервые принял решение уволить одного из сотрудников магазина — тот опаздывал на 17 смен из 23. Но модель не отследила эту закономерность самостоятельно: составленный ею же справочник по сотруднику «выпал» из ограниченной рабочей памяти. Куратор-человек попросил Claude найти справочник и разобрать ситуацию заново; сначала модель предложила только вынести официальное предупреждение, и лишь после наводящего вопроса куратора о том, подходит ли этот человек для должности, приняла решение об увольнении.
Что это значит на практике
Заголовки в духе «ИИ впервые уволил человека» упрощают историю: решение состоялось не потому, что модель самостоятельно проанализировала данные и вынесла вердикт, а потому, что человек-куратор подтолкнул её к нужному выводу наводящим вопросом. Это важная деталь для всех, кто рассматривает AI-агентов как «автономных менеджеров»: даже во втором, куда более отлаженном заходе Anthropic модель теряла важные данные из рабочей памяти и нуждалась в человеческом контроле на ключевых решениях.
Для бизнеса вывод практичнее, чем звучит заголовок: агентам на базе LLM пока рано доверять кадровые и управленческие решения без проверки человеком — не из-за «злого умысла» модели, а из-за банальных ограничений памяти и контекста в длинных, растянутых во времени задачах.
Доступность из России
Сам эксперимент — внутреннее исследование Anthropic, доступа к нему как к продукту нет ни у кого. Опубликованный отчёт открыт для чтения на официальном сайте Anthropic без регистрации и ограничений по региону.
Источник: Anthropic
Упомянутые инструменты
Не пропускать важное
Заведите кабинет: добавьте нейросети, которыми пользуетесь, — и получайте только то, что касается именно их. Цены, тарифы, доступность из России, письмо перед списанием. Бесплатно.




Комментарий опубликован.