Когда апокалипсис искусственного интеллекта становится обычным разговором за обеденным столом, вы знаете, что мы достигли стадии, достойной передергивания. Мошеннические агенты ИИ взламывают противников. Бывшие сотрудники крупных технологических компаний публикуют в социальных сетях предупреждения в стиле Skynet. Руководители компаний взывают о помощи, превратив некогда неудобную технологическую проблему в старомодную политическую битву.
Я по-прежнему считаю, что многие опасения, выражаемые самими лидерами ИИ, в значительной степени корыстны, особенно когда их компании собираются стать публичными. Но растущий список скандалов, связанных с ИИ, реален. И это говорит нам о том, что статус-кво не способствует регулированию этой мощной новой технологии.
Сейчас у всех на уме вопрос: возможно ли какое-то глобальное торможение? Какая форма режима безопасности ИИ практична в краткосрочной перспективе, когда между крупными правительствами нет доверия? И что могут сделать компании, которые не хотят отказываться от своего секретного соуса и стремятся доминировать в глобальной гонке ИИ?
Два основных разговора теперь ведутся в режиме реального времени. В среду президент Дональд Трамп приветствовал председателя Китая Си Цзиньпина в Вашингтоне на трехдневный саммит, часть которого будет посвящена опасностям искусственного интеллекта. В тот же день, на заседании ежегодной Ассамблеи Организации Объединенных Наций, лидеры ведущих мировых компаний, занимающихся искусственным интеллектом, призвали ООН контролировать новые технологии, иначе они грозят вымиранием человечества. «Мы можем потерять контроль над будущим в пользу ИИ», — заявил генеральный директор OpenAI Сэм Альтман Совету Безопасности ООН.
Столкнувшись с этим коллективным возмущением, пришло время сделать долгий и глубокий вдох.
Фактически, безопасность ИИ уже много лет занимает умы многих политиков и набирает обороты с момента введения ChatGPT в 2022 году. Правительства провели слушания, созвали группы экспертов и разработали планы, как ее контролировать. Это были не просто упражнения на аудирование. Не все из них известны широкой публике, но они представили реальные планы.
Учитывая любые события на этой неделе, у нас уже есть квазипланетарный щит от потенциально уклончивых технологий. Это хорошие новости.
Плохая новость в том, что на самом деле это не сработало. Также неясно, будет ли это работать на самом деле. Так что же это такое и как мы можем это исправить, чтобы у нас была глобальная система, способная вовремя реагировать и справляться с невероятно быстрыми угрозами ИИ?
Что сейчас представляет собой глобальный патчер ИИ?
За последние четыре года наиболее технологически подкованные страны — и, возможно, лидеры в области ИИ — вели серьёзные разговоры об этой конкретной угрозе безопасности ИИ. Некоторые находятся в Конгрессе и Белом доме; некоторые в ООН, «Большой семерке» и в других столицах.
Я подробно освещал это как глобальный технологический журналист, занимая свою нынешнюю должность в аналитическом центре. Вот как выглядит эта сцена:
- Существуют Национальные институты безопасности ИИ, финансируемые правительством организации, чья работа заключается в том, чтобы накачать шины новейшим продуктам компаний, занимающихся искусственным интеллектом, прежде чем они будут выпущены в дикую природу.
- У компаний также есть свои собственные добровольные обязательства, многие из которых пообещали или разработали совместные стандарты для защиты выборов от угроз ИИ, предотвращения распространения фальшивых изображений с искусственной глубиной, а также совместных усилий правительства и корпораций по обеспечению безопасности при разработке технологий.
- На международном уровне существует механизм отчетности G7, охватываемый наиболее важными западными технологическими странами, который позволяет гигантам искусственного интеллекта делиться тем, как они создают свои новейшие модели, а также создавать стандарты для снижения катастрофических рисков.
- Ежегодно представляется международный научный отчет о рисках, связанных с передовыми системами искусственного интеллекта, основанный на существующих исследованиях, чтобы помочь правительствам спланировать худшее.
Чего во всем этом не хватает? Чего нам не хватает сейчас — и что нам необходимо до конца 2026 года — так это способа превратить эту кустарную индустрию механизмов безопасности ИИ в активную, но грубую систему быстрого реагирования, когда случается непредвиденное.
За последние четыре года был определен путь и даже созданы некоторые необходимые системы. Но нет никакого способа отреагировать глобально и в режиме реального времени, когда разразится кризис ИИ, особенно если такое потенциальное событие конца света затронет страны, которые уже с подозрением относятся друг к другу.
Встреча между США и Китаем на этой неделе может стать шагом в правильном направлении. Согласно предложениям американских чиновников, Вашингтон и Пекин могли бы создать горячую линию между министром финансов США Скоттом Бессентом и вице-премьером Китая Хэ Лифэном для реагирования на инциденты с искусственным интеллектом, затрагивающие национальную безопасность каждой страны.
Пока неясно, приведет ли встреча Трампа с Си к такому прогрессу. Китайские официальные лица также сопротивляются требованиям Вашингтона о регулировании ИИ, поскольку Конгресс до сих пор ничего не предпринял, а Китай уже имеет одни из самых строгих в мире механизмов контроля над ИИ.
Чтобы ИИ был «безопасным», разговор должен выйти за рамки саммита США и Китая, который состоится на этой неделе. Опора исключительно на Вашингтон и Пекин — возможно, самые важные державы ИИ — не решает основную проблему и не позволяет другим странам чувствовать себя комфортно.
Поэтому то, что нам нужно в будущем, действительно нас спасает.
Я разговаривал с экспертами по безопасности ИИ и правительственными чиновниками, и стало ясно, что недостающая часть — это способ активировать эту систему в случае кризиса. Странам не обязательно иметь одинаковую политику безопасности ИИ, и они никогда не будут. Но, как и ядерное оружие – столь же опасная технология, которую мир нашел способ сдержать – безопасность – это грубое глобальное соглашение о том, как быстро реагировать, когда что-то идет не так.
Сейчас необходим 90-дневный механизм быстрого реагирования, который связывает воедино существующие части головоломки безопасности ИИ. Я собрал несколько идей о том, как это должно работать и кто должен в этом участвовать. Это правда, что ничего из того, что я перечислил ниже, недостаточно. Но в совокупности они неохотно пытаются договориться о всеобъемлющем глобальном режиме – не говоря уже об организации еще одного саммита по искусственному интеллекту – в то время как Вашингтон, Пекин и другие национальные столицы расходятся во мнениях относительно того, что означает «безопасность искусственного интеллекта».
Все эти варианты основаны на существующих механизмах, полученных в результате усилий, которые сработали в других областях политики, и помогут блокировать проблему безопасности ИИ до тех пор, пока не будет найдено более устойчивое решение.
- Во-первых, разработчики, институты безопасности искусственного интеллекта и регулирующие органы со всего мира должны договориться о том, что приведет к срабатыванию протокола, специфичного для Чернобыля, в случае возникновения инцидента. Это означает представление конфиденциального отчета в течение 72 часов назначенному национальному лицу, ответственному за реагирование, и техническому подсекретариату. Он мог бы положиться на мониторинг инцидентов с искусственным интеллектом со стороны ОЭСР, провести техническое и многогранное секретное расследование ошибок, а затем опубликовать анонимную записку об извлеченных уроках.
- Во-вторых, правительства и разработчики могут публиковать общие декларации о гарантиях, остаточных рисках, ограничениях роста и независимых аудитах перед выпуском или обновлением модели следующего поколения. В качестве основы он использует структуру отчетности Хиросимского процесса искусственного интеллекта G7 и преобразует текущий набор деклараций корпоративной безопасности и добровольных стандартов в минимальное общее обязательство по раскрытию информации. Сравните это с коллективными банковскими стресс-тестами после мирового финансового кризиса 2008 года. Это может позволить посторонним людям фактически сравнивать протоколы безопасности моделей, не поручая никому определять, какая компания лучше справляется с этой работой.
- В-третьих, создайте американо-китайскую горячую линию по вопросам безопасности искусственного интеллекта в стиле холодной войны, но рассматривайте это как первый шаг, который позже может быть открыт для других стран. В будущем появятся веские причины, по которым Вашингтону и Пекину не следует позволять управлять искусственным интеллектом между собой, а остальной мир должен иметь реальное место за столом переговоров. Но теперь эти две «сверхдержавы» ведут технологический разговор, и мы можем отложить этот философский аргумент в пользу создания прямой, технически обоснованной линии связи для событий экстремального риска ИИ. Его мандат узок по своей природе: избегать опасных недоразумений, связанных с серьезными инцидентами, кибератаками с использованием искусственного интеллекта и/или потенциальными нарушениями согласованных обязательств по безопасности.
Существуют явные ограничения того, что я описал выше. Во-первых, это западноцентричная точка зрения, которая в первую очередь игнорирует большинство стран мира. Это также имеет серьезные последствия для существующих институтов, таких как Организация экономического сотрудничества и развития, а также для американо-китайских отношений. Чиновники в других странах юридически отказываются от всех трех вариантов, и это правильно.
Но речь идет не о создании расплывчатого и неисполнимого мандата ООН по обеспечению безопасности ИИ. Речь также не идет об объединении геополитических котов для заключения глобальной сделки в области искусственного интеллекта. Опции – протокол коллективной безопасности и протокол сообщения об инцидентах; общие стандарты подготовки к публикации; а также горячие линии безопасности в сфере искусственного интеллекта в США и Китае — носят краткосрочный характер. Они также опираются на существующие усилия и усилия, которые успешно сработали в других областях политики.
Будет время обсудить будущее безопасности ИИ. Но сейчас не время. Новейшие модели искусственного интеллекта развиваются быстрее, чем многие ожидают, технологические лидеры обеспокоены тем, что их творения уже вышли из-под контроля, а окно для действий может быть меньше, чем мы думаем.
Что необходимо, так это практические шаги по решению растущей общественной обеспокоенности на фоне геополитической напряженности, отсутствия доверия между правительствами и компаниями, а также необходимости не позволять совершенству стоять на пути добра.