Что обнаружила компания
О случившемся Anthropic рассказала в подробном отчёте, опубликованном в четверг. Публикация появилась на фоне новых споров о безопасности ИИ: бывший сотрудник компании обвинил её в безответственной разработке мощных систем, хотя, по его словам, Anthropic знала об их разрушительном потенциале.
Учёные из нескольких стран, где Anthropic ограничила доступ к своим моделям, обошли эти ограничения. По данным компании, они пытались скрыть настоящую цель исследований, чтобы не попасть под защитные механизмы Claude.
В одном из случаев, произошедшем в мае, исследователь попросил Claude помочь составить заявку на получение государственного гранта. В ней описывался проект по созданию более опасных мутаций вируса чикунгуньи — переносимой комарами инфекции, которая вызывает лихорадку и сильные боли в суставах. Anthropic считает, что проект могли проводить в военном исследовательском институте.
Глава отдела разведки угроз Anthropic Джейкон Кляйн сообщил The New York Times, что компания не знает, собирались ли использовать результаты в военных целях. При этом, по его словам, исследования по усилению биологических свойств вирусов в военном учреждении вызывают обеспокоенность. Речь идёт об исследованиях с приобретением функции — работах, цель которых состоит в усилении или добавлении биологических свойств организмам и патогенам.
Компания описала ещё четыре похожих случая, в которых учёные обходили защитные ограничения ради сомнительных биологических исследований:
Кляйн подчеркнул, что подобные ситуации редко выглядят как открытое заявление о намерении создать оружие для массового убийства. По его словам, речь идёт о крайне неоднозначных случаях, где намерения пользователей трудно установить однозначно.
Предупреждения об угрозе
ИИ-индустрия много лет предупреждает, что такие системы могут использоваться для создания биологического оружия. Об этом говорил и генеральный директор Anthropic Дарио Амодеи.
В опубликованном ранее в этом году подробном эссе Амодеи заявил, что компания постоянно улучшает защитные механизмы, чтобы её модели не помогали проводить исследования биологического оружия. Он также написал, что для снижения рисков необходимы законодательные меры и международное сотрудничество.
При этом заявления Anthropic о предотвращении злоупотреблений ставят под сомнение способность компании и других разработчиков гарантировать ответственное использование технологий. По собственному признанию Anthropic, её защитные механизмы не сработали. Это потенциально оставляет возможности для новых злоупотреблений в будущем.
Если за попытками действительно стояли государственные структуры, стремившиеся создать биологическое оружие, произошедшее может означать заметное усиление угрозы и приближение к катастрофическим последствиям. Однако это зависит от того, способны ли универсальные модели вроде Claude содержательно помогать в подобных опасных проектах. На фоне споров о безопасности Anthropic также обвиняли в раздувании страхов вокруг собственных технологий ради маркетинга.
Оценка эксперта
Некоторые специалисты считают, что угроза уже стала реальной.
Эндрю Вебер, старший научный сотрудник Совета по стратегическим рискам, ознакомившийся с отчётом Anthropic до публикации, рассказал The New York Times, что его выводы показывают тревожные примеры: разработчики биологического оружия, которых поддерживают государства, начинают использовать быстро растущие возможности передовых моделей ИИ.
Читайте также
Новый Agents API OpenAI даёт разработчикам основу, на которой работают Codex и ChatGPT
Мы должны поставить рискованные исследования ИИ на паузу, пока ещё можем это сделать
Коллективный иск: Anthropic обвиняют в завышении подписочных лимитов Claude с помощью обманных множителей
Книжное соглашение Anthropic на $1,5 млрд тонет в хаосе: авторы и издатели спорят, кому платить
Экономика Великобритании удивила прогнозы, выросши в июле на 0,4%
DeepSeek-V4.1-Flash вышла: $0,003 за 1 млн кэшированных входных токенов вне пика и результаты выше GPT-5.6 Sol и Claude Opus 5
OpenAI хочет выяснить, будет ли вообще законным замедление развития ИИ-отрасли
Anthropic раскрыла кампании по дистилляции Alibaba, Moonshot AI и DeepSeek
Anthropic описала, как злоумышленники пытались использовать её ИИ для биооружия
ToolGrad: датасеты для работы с инструментами генерируют с «текстовыми градиентами»
Дженсен Хуанг объяснил, почему Nvidia вырастет на ошеломительные 70% в следующем году
Исследователи Anthropic предупреждают об опасностях ИИ; Маск называет страхи «психоперацией»
Роботы учатся чувствовать мир на ощупь
OpenAI приостановила новые подписки Pro из-за спроса на Astra
Swarmchasers ищут агентов-отступников, Anthropic расследует себя — общий след темнеет
ИИ-агент Meta Muse стал вторым по популярности приложением в США
Бывший пиарщик DeepMind утверждает, что там запрещали публично обсуждать риск вымирания из-за ИИ
Индийская Pocket FM удвоила годовой темп выручки до $500 млн: ИИ создаёт 93% аудиоконтента
Nvidia и Palantir объединяют усилия для управления цепочками поставок с ИИ — начнут с операций Nvidia на миллионах деталей
Microsoft выпустила образовательные руководства по ИИ для учителей
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram