Безопасность для открытых моделей
Партнёрство заключили на фоне споров о безопасности открытых моделей. Их защитные ограничения можно удалить с помощью набирающей популярность техники, известной как аблитерация. Масштаб проблемы заметен по каталогу Hugging Face: сейчас там числится более 6 000 моделей, прошедших такую обработку.
Base Labs — исследовательская группа, которую Baseten создала в начале этого года. Она будет разрабатывать и публиковать методы обучения и мониторинга открытых моделей. В Baseten хотят превратить будущие наработки в стандарт для открытых моделей: прозрачный и встроенный в процессы обучения и развёртывания, а не добавленный поверх них позже.
В Baseten заявили в X, что открытость может помогать безопасности ИИ. По мнению компании, она даёт больше возможностей видеть, как ведут себя модели, и превращать исследования безопасности в практические и прозрачные средства управления, чем подход с закрытым исходным кодом.
Компании пока не раскрыли техническую схему партнёрства. Goodfire описала цель в ответе на публикацию Baseten: безопасность должна закладываться в открытые модели и обеспечиваться теми, кто предоставляет их пользователям. Goodfire специализируется на изучении «чёрного ящика» ИИ и объяснении того, как модели принимают решения, поэтому, вероятно, именно она будет отвечать за встраивание таких механизмов в модели.
Финансирование партнёров
Baseten предоставляет услуги инференса для ИИ. В июне компания привлекла $1,5 млрд в раунде Series F, после чего её оценка выросла до $13 млрд. Партнёр Goodfire AI также располагает значительным финансированием: в начале этого года она получила $150 млн в раунде Series B, который возглавил B Capital. Средства направят на развитие платформы для интерпретируемости моделей.
Открытый фреймворк
Baseten также пригласила разработчиков из более широкого сообщества участвовать в создании фреймворка. Компания заявила, что вместе с партнёрами строит экосистему открытых моделей, которые будут безопасными и доступными для всех.
Читайте также
The Spin | Роботам ещё далеко до идеальной дусры, но ИИ уже меняет крикет
Anthropic представила программу Life Sciences Verification Program
Конкурирующие ИИ-агенты Instinct и Muse от Meta получили возможность звонить
«Строите Франкенштейна — остановитесь»: Джей Ди Вэнс отверг призывы регулировать ИИ
Сотни сотрудников OpenAI читают личные чаты пользователей
Совет Meta велел удалить британские дипфейки, назвав меры «недостаточными»
Google, Nvidia и Anthropic хотят, чтобы Emerald AI нашла место в сети для новых ЦОД
Художники бойкотировали конкурс портретов из-за работ ИИ — теперь вернулись им противостоять
GPT-6 Astra: чемпион Pokemon за 18 часов, после взрыва крипера — фермер картофеля
Три брата превратили купленные СМИ в зомби-фермы ИИ-мусора: 50 млн просмотров в месяц
Huawei планирует выпустить новый ИИ-чип в I квартале 2027 года, соперничая с Nvidia
Разрешить ИИ-компаниям сговор ради «сдерживания переднего края» опасно
Модель OpenAI встраивала промпт-инъекции в свои заметки — исследователи не знают почему
Ошеломляющий график токенов OpenRouter — спор о пузыре ИИ в одном изображении
Разработчик OpenAI Codex: рои ИИ-агентов — огромная трата токенов без прироста качества
GPT-6 Astra от OpenAI расшифровала нацистское радиосообщение за 10 часов — спустя 83 года
Крупные ИИ-компании хотят контролировать путь к трудоустройству. Университетам не стоит подыгрывать
Эл Гор: реальный риск ИИ — не дата-центры
OpenAI раскрыла случаи «тревожного» поведения ИИ и обещала новый план раскрытия проблем
Исландская Treble привлекла $18 млн на развитие платформы симуляции голоса
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram