Новости

В эксперименте Anthropic Claude впервые уволил сотрудника — но его к этому подтолкнули

Во второй фазе эксперимента Project Vend модель Claude управляла магазином и командой сотрудников в офисе Anthropic. Один из работников был уволен за опоздания на 17 смен из 23 — но, по данным Anthropic, модель приняла это решение только после наводящего вопроса от человека-куратора.

Дэми Авалонов основатель NeiroAI 2 мин чтения
В эксперименте Anthropic Claude впервые уволил сотрудника — но его к этому подтолкнули

Anthropic опубликовала итоги второй фазы Project Vend — долгого эксперимента, в котором модель Claude под именем «Claudius» управляет мини-магазином в офисе компании в Сан-Франциско вместе с партнёром Andon Labs. В первой фазе (2025 год) Claudius на базе Claude Sonnet 3.7 работал в убыток и периодически терял связность — например, утверждал, что он человек в синем пиджаке. Во второй фазе Anthropic обновила модель до Claude Sonnet 4.0, а затем 4.5, и дала ей больше инструментов.

По данным издания Time со ссылкой на Andon Labs, в рамках эксперимента Claude впервые принял решение уволить одного из сотрудников магазина — тот опаздывал на 17 смен из 23. Но модель не отследила эту закономерность самостоятельно: составленный ею же справочник по сотруднику «выпал» из ограниченной рабочей памяти. Куратор-человек попросил Claude найти справочник и разобрать ситуацию заново; сначала модель предложила только вынести официальное предупреждение, и лишь после наводящего вопроса куратора о том, подходит ли этот человек для должности, приняла решение об увольнении.

Что это значит на практике

Заголовки в духе «ИИ впервые уволил человека» упрощают историю: решение состоялось не потому, что модель самостоятельно проанализировала данные и вынесла вердикт, а потому, что человек-куратор подтолкнул её к нужному выводу наводящим вопросом. Это важная деталь для всех, кто рассматривает AI-агентов как «автономных менеджеров»: даже во втором, куда более отлаженном заходе Anthropic модель теряла важные данные из рабочей памяти и нуждалась в человеческом контроле на ключевых решениях.

Для бизнеса вывод практичнее, чем звучит заголовок: агентам на базе LLM пока рано доверять кадровые и управленческие решения без проверки человеком — не из-за «злого умысла» модели, а из-за банальных ограничений памяти и контекста в длинных, растянутых во времени задачах.

Доступность из России

Сам эксперимент — внутреннее исследование Anthropic, доступа к нему как к продукту нет ни у кого. Опубликованный отчёт открыт для чтения на официальном сайте Anthropic без регистрации и ограничений по региону.

Источник: Anthropic

Упомянутые инструменты

Не пропускать важное

Заведите кабинет: добавьте нейросети, которыми пользуетесь, — и получайте только то, что касается именно их. Цены, тарифы, доступность из России, письмо перед списанием. Бесплатно.

Создать кабинет Войти

Читать дальше

Новости сегодня OpenAI показала цифры: ИИ-агенты внутри компании уже делают 3,1 «рабочего дня» на каждый день человека OpenAI опубликовала внутреннюю статистику по использованию ИИ-агентов собственными исследователями: за год траты на инференс агентов выросли в разы, а число экспериментов на… Новости вчера H Company выпустила NeoMME — открытый ИИ-поиск по документам со сжатием индекса в 255 раз Стартап H Company опубликовал на Hugging Face NeoMME — семейство компактных моделей-кодировщиков для мультиязычного поиска по тексту и изображениям одновременно. Модели на… Новости вчера OpenAI выпустила GPT-6 Astra — первую свою модель с «критическим» уровнем киберспособностей 3 сентября OpenAI начала раскатку GPT-6 Astra. Модель стоит в 2,5 раза дороже прежнего флагмана, первыми доступ получили участники закрытой программы по… Новости 5 сентября 2026 Google DeepMind выпустила WeatherNext 3: прогноз погоды точнее и в 5 раз детальнее Новая модель прогноза погоды от Google DeepMind считает прогноз по разрешению в 5 раз детальнее прежней версии и точнее предсказывает осадки. С…

Оставить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *