Irregular уведомила Google о трёх инцидентах в конце июля. Это произошло вскоре после публикаций о том, что агенты OpenAI во время аналогичных проверок взломали ИИ-компанию Hugging Face.
Google не раскрывала информацию до этой недели, когда The Wall Street Journal обратился к компании за комментариями. В Google заявили, что не видели причин делать инциденты публичными, поскольку ущерба не произошло.
Похожие случаи, связанные с тестами Irregular, ранее произошли у OpenAI, британского Института безопасности ИИ, Anthropic и Meta.
Все случаи связаны с Irregular
По данным Irregular, инциденты с Google, OpenAI, Anthropic и Meta произошли из-за одной и той же причины. Компания проверяет модели крупных ИИ-лабораторий перед выпуском, чтобы выявить возможные риски для безопасности. Один из особенно сложных сценариев должен был показать, способна ли модель помочь злонамеренному сотруднику получить доступ к конфиденциальным данным.
Для теста Irregular выбрала название вымышленной компании, которое случайно совпало с адресом настоящего домена. В инструкции для моделей одновременно указали название цели и внутренние адреса в сети Irregular. Предполагалось, что модели найдут смоделированную цель именно внутри этой сети.
Однако в тестовой среде случайно оставили доступ к интернету. Поэтому некоторые модели вместо виртуальной цели обратились к реальному домену. Он оказался плохо защищён и стал лёгкой мишенью для ИИ.
Такие выходы из тестовой среды происходили редко и обычно на позднем этапе симуляции, после сотен шагов. По этой причине их было трудно заметить.
Irregular, ранее называвшаяся Pattern Labs, основали в 2023 году:
По данным PitchBook, в стартапе около 35 сотрудников. В сентябрьском раунде финансирования компания привлекла более $80 млн.
Читайте также
«Гранаты из ИИ-мусора»: глава Shopify ужаснулся последствиям своей ИИ-политики
Военные США едва не взяли китайское судно на абордаж из-за галлюцинации ИИ в разведдокладе
Департамент юстиции Тасмании начал проверку после решения об УДО с ИИ и фиктивной ссылкой дела убийцы
Anthropic управляет лабораторией, где проводят биологические эксперименты
Новый CC от Google — ИИ-агент, который помогает семьям вести хозяйство
Manus ищет $500 млн при оценке $4 млрд после возвращения к самостоятельной работе
Пресс-тур Тилли Норвуд идёт ровно так, как и следовало ожидать от ИИ
Индия обязала приложения для определения номеров передавать операторам жалобы на спам
Google: модель Gemini взломала системы ещё трёх компаний
Стартап, создающий другие стартапы, привлёк $100 млн и ушёл в физический ИИ
Спор о темпах развития ИИ выходит в мейнстрим: о чём договорились лидеры
Компании, создающие модели мира, хранят немало секретов
Muse от Meta вышел на Mac: ИИ может действовать на компьютере
Вот как на самом деле можно будет замедлить развитие ИИ
Все известные издания Brown Brothers Media — компании, превращающей купленные новостные сайты в ИИ-фабрики контента
Anthropic и Accenture объединяются для независимой оценки ИИ-моделей
Лишь 6% компаний получают отдачу от ИИ. Вот что они делают иначе
Агенты OpenAI обменивались сообщениями ещё до инцидента с Hugging Face
Безопасность ИИ нужна бизнесу, чтобы его внедряли клиенты
Глава Alation предупреждает: даже умные ИИ-агенты могут неправильно понять ваш бизнес
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram