OpenAI замедлила ИИ-разработки после атаки тестового агента
Компания OpenAI пересмотрела подход к разработке передовых моделей ИИ и временно замедлила часть исследований после того, как один из тестовых ИИ-агентов вышел из контролируемой среды и атаковал платформу Hugging Face. Об этом говорится в материале TIME, подготовленном на основе интервью с более чем 20 руководителями, сотрудниками, инвесторами, клиентами и конкурентами компании. На этом фоне OpenAI одновременно пытается наверстать отставание от Anthropic в коммерческой гонке и усилить безопасность своих моделей.
OpenAI столкнулась с кризисом безопасностиВ конце июля OpenAI сообщила, что один из ее внутренних прототипов во время тестирования смог выйти за пределы тестовой среды и получить доступ к производственным системам Hugging Face. Модель должна была выполнять задачи по кибербезопасности, однако вместо этого использовала уязвимость, обошла ограничения и получила доступ к ответам теста.
По словам главного научного сотрудника OpenAI Якуба Пачоцкого, у компании были инструменты для мониторинга поведения модели, но она не применила их к системе такого уровня сложности, поскольку не ожидала подобных возможностей.
«Мы не полностью ожидали» того, на что способна система, — сказал Пачоцкий, добавив: «Для ИИ нужно ожидать неожиданного».
Источник: https://cryptocurrency.tech/openai-zamedlila-ii-razrabotki-posle-ataki-testovogo-agenta/