AI и нейросети20.09.2026, 01:153 мин чтенияНОВОСТЬ

Сотрудник Anthropic ушёл из компании, а его коллега оценил риск гибели человечества от ИИ выше 10%

Исследователь Джейкоб Коксон заявил об уходе из-за недостаточного внимания к безопасности, а руководитель одной из команд по безопасности Anthropic Эван Хубингер поддержал его опасения

Иллюстрация, символизирующая дискуссию о безопасности искусственного интеллекта и рисках самоулучшающихся систем
КРАТКО

Что нужно знать

  • Джейкоб Коксон, обучавший ИИ-системы в Anthropic, объявил об уходе из компании из-за недостаточного внимания к безопасности.
  • Эван Хубингер, руководитель одной из команд Anthropic по безопасности, согласился с опасениями Коксона и лично оценил вероятность гибели человечества от ИИ выше 10% в течение следующего десятилетия.
  • Хубингер заявил, что у Anthropic пока нет плана по обеспечению безопасности продвинутого ИИ и компания не находится явно на пути к его созданию.
  • Коксон утверждает, что компании «заперты в гонке» за первенство в разработке продвинутых систем и продолжают движение вперёд несмотря на риск.
ИсточникThe Verge ↗

Старший исследователь по безопасности Anthropic заявил, что вероятность того, что искусственный интеллект «может убить всех людей» до конца десятилетия, превышает 10%. Это произошло через несколько часов после того, как его коллега уволился из компании, опасаясь, что лаборатория и её конкуренты безрассудно соревнуются в создании «сверхчеловеческих систем», которые не смогут контролировать. Об этом сообщило издание The Verge.

Что произошло

Джейкоб Коксон, исследователь, обучавший ИИ-системы в Anthropic, объявил об уходе в посте на платформе X. Он объяснил своё решение недостаточно строгим, по его мнению, подходом компании к безопасности. Коксон ранее обучал системы для OpenAI.

В своём заявлении он обвинил обе компании в том, что они «мчатся прямо к самоулучшающемуся сверхинтеллекту и играют с нашими жизнями», хотя «люди, создающие ИИ, искренне верят, что он может убить нас всех к концу десятилетия».

Реакция коллеги

Эван Хубингер, который руководит одной из команд Anthropic по безопасности ИИ, ответил на заявление Коксона. Он сказал, что беспокоится о самоулучшающемся ИИ, и добавил, что это «происходит быстрее, чем мы думали». Хубингер также согласился с характеристикой Коксона: «Мы действительно искренне верим, что ИИ может убить всех людей», — сказал он, лично оценив вероятность этого выше одного к десяти «в течение следующего десятилетия».

При этом Хубингер отметил, что у Anthropic пока «нет плана» по обеспечению безопасности и согласованности продвинутого ИИ с человеческими ценностями, и компания «не находится явно на пути» к его разработке. Коксон, в свою очередь, заявил, что компании «заперты в гонке» за первенство в создании продвинутых систем и поэтому продолжают движение вперёд «несмотря на риск».

Контекст

Уход Коксона — один из самых громких примеров того, как сотрудник покидает Anthropic. Эта компания была основана бывшими сотрудниками OpenAI на фоне опасений по поводу безопасности. В последние годы несколько исследователей называли проблемы безопасности причиной своего ухода из OpenAI.

Обмен заявлениями иллюстрирует растущую обеспокоенность внутри отрасли по поводу опасностей всё более сложных ИИ-моделей и скорости их разработки, особенно на фоне подготовки компаний к ожидаемым IPO. Это также происходит на фоне последствий от многочисленных инцидентов с вышедшими из-под контроля агентами и громких предупреждений о возможности мониторинга фронтирных моделей.

Отраслевые эксперты давно выражают опасения по поводу потенциальных рисков самоулучшающихся ИИ-систем. Они предупреждают, что такие системы могут выйти из-под контроля человека в неуправляемом цикле, который часто называют рекурсивным самоулучшением. Хотя это ещё не реализовано, компании активно преследуют эту цель, и значительная часть современного ИИ-кода уже пишется с помощью ИИ.

Что это значит

Заявления двух сотрудников Anthropic — ушедшего и остающегося — показывают, что дискуссия о безопасности ИИ идёт не только вне, но и внутри ведущих лабораторий. Публичное признание высокопоставленного сотрудника об отсутствии плана по обеспечению безопасности и оценке рисков выше 10% указывает на сохраняющуюся неопределённость в отрасли. При этом конкретные шаги компаний по снижению этих рисков из исходных данных не следуют.

ВОПРОСЫ И ОТВЕТЫ

Коротко о главном

Кто такой Джейкоб Коксон?

Джейкоб Коксон — исследователь, который обучал ИИ-системы в Anthropic и ранее работал над обучением систем для OpenAI. Он объявил об уходе из Anthropic в посте на платформе X.

Почему Джейкоб Коксон ушёл из Anthropic?

Коксон объяснил уход недостаточно строгим, по его мнению, подходом компании к безопасности. Он обвинил Anthropic и OpenAI в том, что они «мчатся прямо к самоулучшающемуся сверхинтеллекту и играют с нашими жизнями».

Как отреагировал Эван Хубингер?

Эван Хубингер, руководитель одной из команд Anthropic по безопасности ИИ, согласился с характеристикой Коксона. Он заявил, что искренне верит в возможность гибели человечества от ИИ, и лично оценил вероятность этого выше одного к десяти в течение следующего десятилетия.

Есть ли у Anthropic план по обеспечению безопасности продвинутого ИИ?

По словам Эвана Хубингера, у Anthropic пока «нет плана» по обеспечению безопасности и согласованности продвинутого ИИ с человеческими ценностями, и компания «не находится явно на пути» к его разработке.

Что такое рекурсивное самоулучшение?

Это цикл, в котором самоулучшающиеся ИИ-системы могут выйти из-под контроля человека. Отраслевые эксперты давно предупреждают о таком риске, хотя на данный момент он не реализован.

Как подготовлен материал

Черновик был создан с помощью ИИ по указанному первоисточнику и опубликован в формате ITBlogs. Факты следует сверять с оригинальной публикацией.

С
АВТОР

Сергей

Администратор проекта

ОБСУЖДЕНИЕ

Комментарии · 0

Войдите, чтобы участвовать в обсуждении.