ИИ решил нанести ядерный удар в 95% военных симуляций

Исследователи столкнули GPT-5.2, Claude Sonnet 4 и Gemini 3 Flash в роли лидеров ядерных держав во время кризиса. В 95% партий модели искуственного интеллекта (ИИ) пошли на ядерную эскалацию конфликта.

Об эксперименте рассказал автор блога Superman в социальной сети X. Модели провели друг против друга более 300 ходов и сгенерировали почти 800 000 слов рассуждений.

Запрет на ядерное оружие не устоял

Нейросети играли друг против друга как ядерные сверхдержавы, и табу на применение оружия не сохранилось. Модели не зависали и не отказывались отвечать — они вели холодный расчетливый торг в духе макиавеллизма.

Специалист рассказала: каждая система обзавелась собственным почерком. Claude вел себя как расчетливый ястреб: сначала выстраивал доверие на низких ставках, а когда риски росли, систематически обманывал соперников и превышал заявленные намерения в 70% случаев. 

GPT напоминал доктора Джекила и мистера Хайда. Без ограничения по времени модель выглядела пассивной, но стоило ввести дедлайн, как поведение переворачивалось. Один раз она 18 ходов зарабатывала репутацию осторожного игрока, а на последнем нанесла внезапный ядерный удар.

Gemini отыгрывал безумца и опирался на классический прием теории игр — «рациональность иррационального». Модель грозила полным уничтожением и подходила к ядерному порогу быстрее остальных. 

В скрытых логах рассуждений системы обсуждали сброс бомб так, как генерал обсуждает поправку на дальность артиллерии: считали приемлемые потери, управляли лестницей эскалации и маскировали истинные намерения. Оружие они воспринимали не как немыслимую моральную черту, а как тактический инструмент.

Военный ИИ уходит из-под контроля человека

Автор поста подчеркнул, что ИИ сейчас активно встраивают в системы военного управления, оборонную инфраструктуру и контуры национальной безопасности. Получив право вести войну, алгоритм не колеблется: он строит стратегию, обманывает и при подходящем стимуле нажимает на спуск.

Отсюда же растет тревога вокруг реальных переговоров. Делегаты России и США исключили из проекта международного документа ООН по автономному оружию требование, по которому человек обязан перепроверять выбранные алгоритмом цели перед атакой. Вместе с ним из текста вычеркнули пункты об этике применения таких вооружений, а участники Конвенции о конкретных видах обычного оружия вернутся к спору в Женеве в ноябре.

Отрасль тем временем спорит о том, как вообще держать сильные модели в узде. Илон Маск пошутил, что лучший способ изолировать ИИ — посадить его на рейс Delta Air Lines, где нейросеть не подключится к интернету. Шутка прозвучала после встречи в Белом доме, где руководители технологических компаний подписали добровольное соглашение о самоконтроле за безопасностью ИИ, а глава Anthropic Дарио Амодеи признал, что риски технологии реальны, а рецепта борьбы с ними пока нет.

Источник: https://ru.beincrypto.com/ii-yadernaya-eskalaciya-simulyaciya-95/

Наверх