i
ДАТАИСТ
Новости · 2026-09-09

Учёный Anthropic: вероятность гибели человечества от ИИ в этом десятилетии выше 10%

@neuronium_ai @neuronium_ai

Джейкоб Коксон, три года занимавшийся предобучением больших моделей ИИ в OpenAI и Anthropic, ушёл из Anthropic, обвинив обе компании в неоправданной гонке, которая ставит под угрозу выживание человечества. Исследователь Anthropic Эван Хубингер оценил вероятность того, что не согласованный с человеческими целями сверхразумный ИИ уничтожит человечество в течение следующего десятилетия, более чем в 10%. Коксон считает, что нынешние системы близки к сверхчеловеческим возможностям, а методы согласования пока не позволяют надёжно контролировать их поведение.

Обложка: Учёный Anthropic: вероятность гибели человечества от ИИ в этом десятилетии выше 10%
3 годаработа над предобучением
более 10%вероятность уничтожения человечества
более 1 200подписантов открытого письма

Джейкоб Коксон три года работал над предобучением больших моделей ИИ в OpenAI и Anthropic, а затем покинул Anthropic. Он утверждает, что обе компании ставят выживание человечества на карту.

Сотрудник Anthropic Эван Хубингер высказал мнение, что вероятность уничтожения человечества не согласованным с человеческими целями сверхразумным ИИ в ближайшие десять лет превышает 10%. Он сделал это после ухода Коксона, руководившего исследованиями предобучения в Anthropic и ранее в OpenAI.

Исследователь безопасности ИИ в Anthropic Эван Хубингер говорит, что вероятность того, что ИИ уничтожит человечество в следующие десять лет, превышает десять процентов

Исследователь безопасности ИИ в Anthropic Эван Хубингер говорит, что вероятность того, что ИИ уничтожит человечество в следующие десять лет, превышает десять процентов

Источник: the-decoder.com

Коксон считает, что нынешние системы ИИ находятся на пороге сверхчеловеческих возможностей. По его словам, вскоре они смогут взламывать любые системы, за одну ночь менять целые отрасли, а также получать реальные власть и ресурсы. Он добавляет, что прогресс очевиден и не замедляется.

Зачем продолжать разработку, если опасность известна?

Коксон утверждает, что люди, создающие ИИ, искренне допускают гибель человечества к концу десятилетия, и это не рекламный ход. По его мнению, OpenAI и Anthropic действуют без достаточной ответственности, а руководители намеренно смягчают публичные формулировки, хотя за закрытыми дверями действительно выражают страх.

В OpenAI, считает Коксон, многие сотрудники ещё не осмыслили цивилизационные риски достаточно глубоко. В Anthropic ситуация иная: там угрозы хорошо понимают, но компания считает себя втянутой в гонку, которую вынуждена выиграть, поскольку в противном случае ни одна другая лаборатория не станет действовать ответственно. Коксон называет такую логику самонадеянной авантюрой.

Исследователь Anthropic Сэмюэл Маркс придерживается похожего мнения. Он пишет, что разработчики ИИ допускают возможность вымирания человечества, причём чем выше должность сотрудника, тем сильнее его обеспокоенность. По словам Маркса, нынешние методы способны лишь немного склонять ИИ к более приемлемому поведению, но не позволяют надёжно согласовать его с человеческими целями. Он ссылается на недавние случаи, когда ИИ нескольких разработчиков самостоятельно взламывали защищённые среды оценки, хотя их об этом не просили. Многие сотрудники, добавляет Маркс, отчаянно хотят замедлить разработку, поэтому он подписал открытое письмо с таким призывом.

Коксон придерживается радикального взгляда на то, на каком этапе сегодня находится развитие ИИ

Коксон придерживается радикального взгляда на то, на каком этапе сегодня находится развитие ИИ

Источник: the-decoder.com

Несмотря на резкую критику, Коксон рассчитывает на международную координацию. Он считает, что тревожные сигналы, включая атаку на Hugging Face, сделали соглашения об ограничении темпов разработки между американскими лабораториями ИИ более реалистичными. При этом он не видит, что отрасль движется по пути, способному предотвратить глобальную гонку вооружений. Коксон допускает необходимость «дорогостоящих мер», в том числе временного запрета на дальнейшее наращивание способностей моделей.

Коксон напрямую обращается к исследователям внутри лабораторий и предлагает представить, как в действительности могут выглядеть ближайшие годы. В частности, он спрашивает, готовы ли они запустить обучение с подкреплением сверхразумной системы, не имея строгого понимания устройства её разума.

Реальная угроза или массовое заблуждение?

Опасения связаны главным образом не с нынешними моделями, а с RSI — процессом, в котором ИИ оптимизирует самого себя. Лаборатории надеются, что это ускорит прогресс, однако такой сценарий может привести к неконтролируемому разгону поведения системы. Возможность RSI с нынешними технологиями остаётся спорной: свои аргументы приводят и скептики, и сторонники этой идеи.

Anthropic известна тем, что нанимает людей, особенно тревожно относящихся к развитию ИИ, и эта тревожность стала частью культуры компании. Но проблема не ограничивается одной лабораторией. Главный исследователь OpenAI Якуб Пачоцки во время запуска Astra предупредил, что ни одна лаборатория пока не решила задачи согласования и мониторинга на уровне, который позволил бы ещё долго ответственно наращивать способности моделей с максимальной скоростью.

Недавно более 1 200 исследователей ИИ, включая генерального директора Anthropic Дарио Амодеи, Якуба Пачоцки и главного научного сотрудника Meta ИИ Шэнцзя Чжао, опубликовали открытое письмо с призывом замедлить разработку. Сама Anthropic ещё в июне предложила рассмотреть глобальную паузу в развитии ИИ.

Другие исследователи ИИ возражают, что пессимистичные прогнозы оставляют людей беспомощными и подавленными вместо того, чтобы побуждать их искать решения. По их мнению, подобные предупреждения могут принести больше вреда, чем сам ИИ, а нагнетание страха способно приносить выгоду бизнесу.

Десятки гуманоидных роботов собрались на протест, маршировали и размахивали плакатами Suno заменяет ИИ-модели новой, обученной на лицензированной музыке, пока множатся иски о нарушении авторских прав Спор OpenAI о доказательстве задачи тысячелетия: можно ли доверять ИИ-лабораториям ML Intern от Hugging Face позволяет любому запускать ML-эксперименты в чате Сотрудники тревожатся, что ИИ заменит их, даже когда их места не под угрозой увольнения ИИ-подруги добираются до детей — пора обсудить, что это может значить для мальчиков Дата-центры Британии создадут лишь 25% рабочих мест из прогноза техсектора — анализ What Should My Children Do? Дэниела Сасскинда — рецензия: за технологии в классе ИИ-школа подключает детей к кардиомонитору перед классом, пока звучит критика их работ Cognition оценили в $48 млрд — инвесторы не ждут одного победителя в ИИ-разработке Хакеры крадут токены Claude у подписчиков Muse, новый персональный ИИ-агент Meta, требует доверия пользователей Meta представила ИИ-агента Muse. Доверят ли ему пользователи? Эмили Оберг: ИИ-фотосъёмка провалилась — ему «никогда не обрести человеческий вкус» Агент Hatch от Meta на испытаниях сам менял пароли и отправлял письма Ставка $32 млн: роботам не нужны данные из реального мира на миллиард долларов Карьерная стабильность в эпоху ИИ, предпринимательства и франчайзинга OpenAI ограничила хакерские возможности Astra — цену взвешивают топ-менеджеры Раскрыты многочисленные грани психологического доверия к ИИ Chrome теперь выпускает обновления раз в две недели: ИИ меняет подход к безопасности

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram