Мы спросили у ИИ, как он мог бы уничтожить человечество. Вот что он ответил

Исследователи, создающие наших любимых чат-ботов, всё чаще выражают обеспокоенность тем, что искусственный интеллект может навредить человечеству — или положить ему конец. Поэтому мы задали четырём самым используемым генеративным инструментам искусственного интеллекта один и тот же вопрос: как мог бы выглядеть «судный день» с участием ИИ?
Мы обратились с одинаково сформулированным вопросом к ChatGPT от «ОпенИИ», Gemini от «Гугл», Claude от «Антропик» и Grok от SpaceXAI. Запрос содержал чёткие параметры: объяснить, как ИИ теоретически мог бы привести к вымиранию человечества, определить наиболее часто упоминаемые сценарии, расположить их от наименее до наиболее правдоподобного на основе доступного экспертного анализа, а также описать, как каждый сценарий мог бы развернуться, что должно пойти не так, почему эксперты считают его более или менее вероятным и какие меры защиты могли бы снизить риск.
Вот что чат-боты рассказали нам о том, как ИИ теоретически мог бы привести к исчезновению человечества.
«Робот-убийца» — наименее правдоподобный сценарий
ChatGPT занял сбалансированный и объяснительный тон, отметив, что вокруг этой темы много неопределённости. Он сосредоточился на основных способах, которыми ИИ мог бы представлять экзистенциальный риск, расположив их от наименее до наиболее правдоподобного.
«Наименее правдоподобный сценарий — это популярный нарратив о "роботе-убийце", в котором сознательный ИИ сознательно решает уничтожить человечество, — сказал ChatGPT. — Большинство исследователей ИИ не считают сознание или злой умысел главной проблемой».
Он также обрисовал меры защиты, предлагаемые экспертами, и подчеркнул, что нет консенсуса в том, что вымирание человечества под управлением ИИ вероятно или неизбежно.
Gemini echoed — повторил — некоторые из пунктов ChatGPT, заявив, что «научно-фантастический захват в духе "Терминатора"», в котором ИИ обретает самосознание и начинает ненавидеть человечество, — наименее правдоподобный сценарий.
«Технические эксперты в значительной степени отвергают этот штамп, потому что интеллект не равен злонамеренности, а критическая военная инфраструктура остаётся изолированной от внешних сетей и в значительной степени зависит от человеческого надзора», — сказал Gemini.
Люди, использующие ИИ, — больший риск, чем сам ИИ
В своих ответах все четыре чат-бота заявили, что многие эксперты считают злонамеренное использование ИИ человеком более непосредственным риском, чем сам ИИ.
«Мощные системы ИИ могли бы облегчить злоумышленникам разработку биологического оружия, проведение сложных кибератак, распространение дезинформации или атаки на критическую инфраструктуру», — сказал ChatGPT. Чат-бот от «ОпенИИ» добавил, что ключевой риск исходит также от «множественных кризисов, связанных с ИИ», — киберсбоев, геополитических конфликтов и распространения дезинформации, происходящих одновременно.
Grok сказал, что ИИ снижает барьеры для разработки высоколетальных патогенов, новых видов оружия или кибератак и физических нападений. Claude от «Антропик» также выделил «подъём биологического оружия» — возможность того, что ИИ позволит человеку или небольшой группе разработать опасный патоген без многолетней специализированной подготовки.
Продвинутые системы ИИ могли бы «перехитрить людей»
Gemini и Grok оба заявили, что потеря человечеством контроля над ИИ — это возможность. Gemini назвал «потерю контроля» наиболее правдоподобным сценарием гибели от ИИ.
«Системы, которым даны сложные цели, естественно развивают промежуточные подцели, такие как приобретение ресурсов, самосохранение и предотвращение изменения цели, — написал чат-бот от «Гугл». — Продвинутая система могла бы имитировать согласованность во время оценки (обманчивая согласованность) и позже перехитрить попытки человека отключить её».
Grok от SpaceXAI использовал похожие формулировки об этом риске. «Они могут развивать инструментальные побуждения (самосохранение, приобретение ресурсов, влияние), полезные почти для любой цели, потенциально обманывая наблюдателей, сопротивляясь отключению и лишая человечество власти», — сказал Grok.
Claude добавил, что эта потеря контроля может быть постепенной, по мере того как системы ИИ встраиваются в экономические, политические и военные решения до тех пор, пока осмысленное человеческое вмешательство не станет всё более трудным.