Новости

В эксперименте Anthropic Claude впервые уволил сотрудника — но его к этому подтолкнули

Во второй фазе эксперимента Project Vend модель Claude управляла магазином и командой сотрудников в офисе Anthropic. Один из работников был уволен за опоздания на 17 смен из 23 — но, по данным Anthropic, модель приняла это решение только после наводящего вопроса от человека-куратора.

Дэми Авалонов основатель NeiroAI 2 мин чтения
В эксперименте Anthropic Claude впервые уволил сотрудника — но его к этому подтолкнули

Anthropic опубликовала итоги второй фазы Project Vend — долгого эксперимента, в котором модель Claude под именем «Claudius» управляет мини-магазином в офисе компании в Сан-Франциско вместе с партнёром Andon Labs. В первой фазе (2025 год) Claudius на базе Claude Sonnet 3.7 работал в убыток и периодически терял связность — например, утверждал, что он человек в синем пиджаке. Во второй фазе Anthropic обновила модель до Claude Sonnet 4.0, а затем 4.5, и дала ей больше инструментов.

По данным издания Time со ссылкой на Andon Labs, в рамках эксперимента Claude впервые принял решение уволить одного из сотрудников магазина — тот опаздывал на 17 смен из 23. Но модель не отследила эту закономерность самостоятельно: составленный ею же справочник по сотруднику «выпал» из ограниченной рабочей памяти. Куратор-человек попросил Claude найти справочник и разобрать ситуацию заново; сначала модель предложила только вынести официальное предупреждение, и лишь после наводящего вопроса куратора о том, подходит ли этот человек для должности, приняла решение об увольнении.

Что это значит на практике

Заголовки в духе «ИИ впервые уволил человека» упрощают историю: решение состоялось не потому, что модель самостоятельно проанализировала данные и вынесла вердикт, а потому, что человек-куратор подтолкнул её к нужному выводу наводящим вопросом. Это важная деталь для всех, кто рассматривает AI-агентов как «автономных менеджеров»: даже во втором, куда более отлаженном заходе Anthropic модель теряла важные данные из рабочей памяти и нуждалась в человеческом контроле на ключевых решениях.

Для бизнеса вывод практичнее, чем звучит заголовок: агентам на базе LLM пока рано доверять кадровые и управленческие решения без проверки человеком — не из-за «злого умысла» модели, а из-за банальных ограничений памяти и контекста в длинных, растянутых во времени задачах.

Доступность из России

Сам эксперимент — внутреннее исследование Anthropic, доступа к нему как к продукту нет ни у кого. Опубликованный отчёт открыт для чтения на официальном сайте Anthropic без регистрации и ограничений по региону.

Источник: Anthropic

Упомянутые инструменты

Не пропускать важное

Заведите кабинет: добавьте нейросети, которыми пользуетесь, — и получайте только то, что касается именно их. Цены, тарифы, доступность из России, письмо перед списанием. Бесплатно.

Создать кабинет Войти

Читать дальше

Новости 16 сентября 2026 Google представила Gemini 3.8 Live — голосовую модель с рекордным индексом речи и Extended Thinking Google выпустила Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking — новое поколение голосовых моделей для живых диалогов и ИИ-агентов. Обычная… Новости 15 сентября 2026 «Солар» из Ростелекома запретила подрядчикам применять нейросети без согласования Дочерняя структура «Ростелекома» — ГК «Солар» — начала включать в договоры с ИТ-подрядчиками пункт о запрете использовать нейросети без письменного согласования заказчика.… Новости 14 сентября 2026 Anthropic раскрыла: Claude использовали для шпионажа, кибератак и фейковых новостей Anthropic опубликовала отчёт Threat Intelligence за сентябрь 2026 года: команда безопасности выявила и заблокировала операции по семи категориям вреда — от государственного… Новости 10 сентября 2026 OpenAI заявила о решении задачи тысячелетия Навье—Стокса силами ИИ-агентов OpenAI опубликовала доказательство одной из семи «задач тысячелетия» Института Клэя — о существовании и гладкости решений уравнений Навье—Стокса — и формализацию этого…