Южная Корея и Великобритания совместно провели Сеульский саммит по ИИ — вторую встречу в серии, начатой в Блетчли-парке в ноябре 2023 года. Повестка разделилась чётко. На корпоративном треке ведущие разработчики приняли публичные обязательства по безопасности. На правительственном треке государства договорились углубить сотрудничество в области науки оценок. Что каждый трек дал и что оставил открытым — до сих пор самый ясный индикатор состояния управления сверхразум в 2024 году.

Обязательства и правительственный след были публичными документами без силы закона.

Обязательства по безопасности передового ИИ

Заглавным документом стали Обязательства по безопасности передового ИИ, подписанные шестнадцатью крупными ИИ-компаниями, включая разработчиков из США, Китая, Великобритании и ОАЭ. Компании обязались публиковать рамки безопасности с описанием того, как они оценивают риски передовых моделей; определять пороги риска, которые считают неприемлемыми; и, что особенно важно, не разрабатывать и не развёртывать модели, если эти пороги не удаётся удержать ниже установленной линии, включая обязательство отступить, если меры по снижению риска не срабатывают.

Содержательный сдвиг заключался в публичном принципе. Ведущие разработчики заявили официально, что некоторые возможности слишком опасны для развёртывания и что они определят красные линии и будут их соблюдать. Индустрия перешла от расплывчатых заверений к заявленным ограничениям. Ограничения остались самоопределёнными.

Почему добровольных обязательств недостаточно

  • Компании сами устанавливают свои пороги. Каждый разработчик сам определяет, что считать недопустимым риском и как его измерять. Общего стандарта и внешнего органа, проверяющего эти определения, нет.
  • Нет независимой проверки. Ничто не подтверждает, что внутренние рамки безопасности соблюдаются или что оценки честны. Соблюдение держится только на слове разработчика.
  • Нет принуждения. Нарушение залога несёт репутационные издержки, и залог не является законом.
  • Их можно пересмотреть или отменить. Добровольные обязательства под давлением конкуренции могут незаметно размываться, когда соперник вырывается вперёд. Саморегуляция именно такая хрупкая.

Обещание, которое обещающий может определить, измерить и разорвать, является заполнителем управления. Заполнители помогают, только если что-то более сложное заменяет их нарочно.

Сеть институтов безопасности

Правительственный трек создал нечто с более устойчивым потенциалом: импульс к международной сети институтов безопасности ИИ. Опираясь на недавно созданные органы Соединенного Королевства и Соединенных Штатов, государства согласились сотрудничать в области науки оценки пограничных моделей, обмена методами, согласования испытаний и создания технического потенциала, который потребуется любому будущему режиму проверки. Общественные органы, которые могут реально оценить, является ли модель опасной, являются соединительной тканью, которую в конечном итоге требует договор.

Сеульская декларация, одобренная собравшимися правительствами, подтвердила приверженность человекоориентированному, безопасному и заслуживающему доверия ИИ и продолжению международного сотрудничества. Как и текст из Блетчли, это было заявление о направлении, а не набор обязательств.

Шаблон и разрыв

Сеул вписывается в известную схему управления опасными технологиями: признание, затем добровольные обязательства, затем (если процесс удастся) обязательные правила. Корпоративные обещания и сеть институтов — это вторая стадия. Незавершённая работа — третья: общие стандарты, независимая проверка и юридические обязательства.

Институты безопасности — самый перспективный мост, потому что именно тот потенциал, который они наращивают, и понадобится для обязательного режима. Риск в том, что процесс саммитов застрянет на стадии добровольных обязательств, мир удовлетворится обещаниями, поскольку их проще давать, чем заключать договоры, а возможности продолжат расти. Сеул показал разрыв между обещаниями и реальным управлением. Осталось его закрыть. Позиция Фонда: закрыть его — значит перейти от обещаний компаний к превентивное международное право прежде чем самостоятельно установленные красные линии растворятся под давлением гонки. Дополнительные материалы: почему добровольные обязательства по безопасности ИИ не работают как единственная стратегия.