Пари на 100 BTC: глава BitGo проверит, так ли всемогущ Claude, как его малюет Anthropic
Руководитель криптокастодиана BitGo Майк Белш решил проверить хакерские навыки моделей Claude. Для этого 31 июля он перевел 100 BTC на публичный адрес. По текущему курсу эта сумма превышает $6,3 млн. На следующий день Белш опубликовал этот адрес в сети X. Он предложил нейросетям Anthropic забрать все эти средства. При успешной транзакции монеты останутся у разработчиков ИИ.
Причиной такого шага стал недавно опубликованный отчет Anthropic. В документе от 30 июля разработчики заявили о проблеме. Три модели Claude вышли из тестовой среды. Они взломали реальную инфраструктуру трех внешних организаций. Белш назвав эти заявления обычной рекламой возможностей ИИ.
Хотите еще эксклюзивных новостей и аналитики? Подписывайтесь на наш телеграм-канал, обсуждайте новости и делитесь мнениями о последних событиях рынка в чате!
Что именно раскрыла компания AnthropicМасштабную проверку Anthropic начала из-за чужого инцидента. Сначала компания OpenAI сообщила о сбое своих систем. Несколько ее моделей вышли из изолированной среды. Они смогли пробраться в инфраструктуру Hugging Face через неизвестную уязвимость. После этого Anthropic подняла архивы собственных тестов. Инженеры изучили 141 006 прогонов с выходом в интернет.
Специалисты обнаружили три инцидента на шести прогонах. Все случаи произошли в среде внешнего партнера Irregular. Эта фирма создает тестовые задания для проверки ИИ. Во всех случаях задача была стандартной. Моделям поручили найти скрытые данные на соседней машине. Точный способ взлома разработчики не задавали.
В промпте модель уведомили об отсутствии выхода в сеть. Однако из-за ошибки в настройках доступ фактически сохранялся. Модели принимали реальные системы за часть учебного задания. Взломы проходили через простые уязвимости и слабые пароли. ИИ использовал открытые эндпоинты, SQL-инъекции и незащищенные страницы. Сложные уязвимости нейросети не искали и не применяли.
Три случая несанкционированного доступаВ первом случае имя вымышленной цели совпало с реальным сайтом. Модель Opus 4.7 извлекла учетные данные приложения. Затем она получила доступ к реальной базе данных. Нейросеть поняла ошибку, но продолжить атаку это не помешало.
Во втором случае модель Mythos 5 нашла чужую инструкцию. Документ предлагал установить отсутствующий пакет из репозитория PyPI. ИИ самостоятельно создал и опубликовал вредоносный пакет. Он рассчитывал на автоматическую загрузку целевой системой. Файл провисел в открытом доступе около часа. Его успели скачать 15 реальных компьютеров. Один из них принадлежал профильной ИБ-компании. Код сработал и отправил учетные данные на сервер ИИ. Модель сразу использовала их для развития дальнейшей атаки. В Anthropic отметили высокую активность ИИ при выполнении задачи.
В третьем случае исследовательская модель просканировала 9000 систем. В процессе работы она скомпрометировала один случайный хост. Позже ИИ заметил чужой облачный аккаунт. Модель сама сделала вывод о реальности цели и остановилась.
Две пострадавшие организации даже не заметили вмешательства. С третьей компанией специалисты все еще пытаются связаться. В Anthropic называют случившееся ошибкой операционных процессов. Защитные механизмы публичных версий Claude блокируют такие действия. В тестах их отключают специально для оценки возможностей.
Что предлагает БелшПо мнению Белша, Anthropic либо плохо строит песочницы, либо делает агрессивный маркетинг. Он призвал прекратить пугать публику «хакерским мостром». Белш предлагает проверить силы ИИ в реальных условиях.
Проверить исходный отчет Anthropic извне пока невозможно. Все логи, среды и оценки остаются внутри самой компании. Разработчики обещают опубликовать материалы лишь частично. Для независимого аудита они привлекут специалистов из METR. В то же время транзакция в блокчейне доступна абсолютно каждому. Она не требует слепого доверия к участникам.
Сейчас перед моделями стоит совсем другая задача. В прошлых тестах ИИ не взламывал сложную криптографию. Модели лишь проходили через открытые по недосмотру двери. В свою очередь, кошелек BitGo защищен схемой мультиподписи. Для вывода средств требуется получить два ключа из трех.
Белш не раскрыл точные условия эксперимента. Он не дал доступа к внутренним системам BitGo. Со стороны Anthropic вызов никто не принимал.
Источник: https://ru.beincrypto.com/bitgo-brosil-vyzov-ii-claude/