OpenAI, Anthropic, Google и Microsoft создают форум по безопасности передовых ИИ-моделей

Четыре разработчика ИИ учредили Frontier Model Forum для совместной работы над оценкой рисков, стандартами безопасности и обменом данными. На момент анонса у инициативы ещё не было опубликованных правил управления и обязательных требований.

Компании OpenAI, Anthropic, Google и Microsoft объявляют о создании Frontier Model Forum
Компании OpenAI, Anthropic, Google и Microsoft объявляют о создании Frontier Model Forum
College of DuPage Hosts Career Fair 2016 13 | by COD Newsroom | openverse | by

OpenAI, Anthropic, Google и Microsoft объявили 26 июля 2023 года о создании Frontier Model Forum — отраслевой организации для работы над безопасностью наиболее мощных систем искусственного интеллекта. Основатели намерены совместно развивать методы оценки моделей, формировать практики ответственной разработки и обмениваться информацией с государственными структурами, исследователями и гражданским обществом.

Инициатива пока представляет собой заявленную площадку для сотрудничества, а не регулятора или орган сертификации. В первоначальном анонсе OpenAI не были представлены обязательные стандарты, результаты независимых проверок или санкции за нарушение будущих правил. Поэтому создание форума само по себе не меняет условия использования API и других продуктов компаний.

Какие модели форум считает передовыми

Основатели используют термин frontier models для обозначения крупномасштабных моделей машинного обучения, возможности которых превосходят наиболее продвинутые существующие системы и позволяют решать широкий круг задач. Формулировка охватывает не только языковые модели: к этой категории потенциально могут относиться мультимодальные и другие универсальные системы.

При этом в стартовом сообщении нет числового порога, по которому модель автоматически признаётся передовой. Не указаны минимальное количество параметров, объём вычислений, результаты на конкретных тестах или наборы опасных возможностей. Практическое определение категории, следовательно, будет зависеть от методик, которые форум ещё должен разработать.

Для разработчиков это существенная оговорка. Пока нет формальных критериев, нельзя утверждать, что любые рекомендации форума будут распространяться на определённую модель, API или открытый проект. Также не следует считать членство компании подтверждением безопасности всех её продуктов: о процедуре сертификации в анонсе речи не идёт.

Четыре направления работы

В заявлении перечислены четыре основные задачи Frontier Model Forum.

Первая — поддержка исследований в области безопасности передовых моделей. Основатели говорят о снижении рисков и создании независимых стандартизированных оценок возможностей и безопасности систем. Однако порядок проведения таких оценок и условия доступа внешних исследователей на старте не раскрывались.

Вторая задача — определение практик ответственной разработки и внедрения моделей. В эту работу могут войти технические тесты, сравнительные показатели и способы информирования пользователей о возможностях, ограничениях и потенциальном влиянии систем. Публикация конкретного стандарта одновременно с созданием форума не анонсировалась.

Третье направление — взаимодействие с политиками, научным сообществом, общественными организациями и другими компаниями. Предполагается обмен знаниями о рисках, связанных с доверием и безопасностью. Формат такого обмена — открытые отчёты, закрытые консультации или совместные исследования — ещё предстояло определить.

Наконец, участники хотят поддерживать применение ИИ для общественно значимых задач. В качестве примеров основатели называют борьбу с изменением климата, раннее выявление рака и противодействие киберугрозам. Это заявленные области интереса, а не объявленные продукты или подтверждённые исследовательские программы.

Anthropic в своём сообщении о запуске форума приводит тот же круг основателей и целей. Наличие отдельных публикаций компаний подтверждает согласованность анонса, но не заменяет независимую оценку будущей работы организации.

Кто сможет присоединиться

Frontier Model Forum заявлен как открытая для новых участников организация, однако членство предназначено не для любой компании, использующей ИИ. Кандидат должен разрабатывать и внедрять модели, подходящие под определение передовых, демонстрировать серьёзную приверженность безопасности и быть готовым участвовать в совместных инициативах.

Таким образом, форум ориентирован прежде всего на разработчиков базовых моделей, а не на стартапы, создающие приложения поверх сторонних API. Участие университетов, независимых специалистов и общественных организаций предполагается через консультации и будущий консультативный совет, но в число первоначальных членов они не вошли.

На момент объявления основатели только планировали сформировать консультативный совет, подготовить устав, определить систему управления и финансирование. Персональный состав органов управления и распределение голосов между компаниями не раскрывались. Не было также ясно, смогут ли внешние эксперты публиковать особые мнения или проверять заявления участников без ограничений.

Эти детали важны для оценки независимости форума. Когда правила безопасности разрабатывают сами поставщики моделей, остаётся открытым вопрос о контроле исполнения и публикации неблагоприятных результатов тестирования.

Инициатива появилась на фоне давления со стороны властей

Анонс последовал через пять дней после того, как администрация президента США сообщила о добровольных обязательствах семи технологических компаний в области безопасности ИИ. К ним присоединились Amazon, Anthropic, Google, Inflection, Meta, Microsoft и OpenAI.

В материале Белого дома от 21 июля 2023 года перечислены предварительное внутреннее и внешнее тестирование систем, обмен сведениями о рисках, защита весов моделей, механизмы сообщения об уязвимостях и информирование общества об ограничениях ИИ. Отдельно упоминается разработка технических средств, помогающих распознавать созданный ИИ контент.

Frontier Model Forum частично пересекается с этими обязательствами, но имеет иной статус. Это инициатива компаний, а не государственная программа, закон или международное соглашение. Её рекомендации не получают юридической силы только потому, что их поддержали крупные поставщики моделей.

Форум также не следует смешивать с более широкими объединениями в сфере ответственного ИИ. Его отличительная особенность — фокус на организациях, непосредственно создающих наиболее мощные универсальные модели. Такой состав может ускорить технический обмен, но одновременно ограничивает участие независимых сторон в принятии решений.

Что проверять разработчикам и пользователям

Немедленных изменений в API, лицензиях или процедурах доступа к моделям анонс не вводит. Разработчикам не нужно предпринимать технические действия только из-за появления форума. Реальное значение инициативы станет понятнее после публикации рабочих документов.

В последующих сообщениях стоит искать четыре конкретных признака:

  • измеримые критерии, по которым система относится к передовым моделям;
  • открытые методики тестирования и результаты оценок до выпуска моделей;
  • правила раскрытия инцидентов, уязвимостей и известных ограничений;
  • структуру управления, роль внешних экспертов и механизм контроля выполнения рекомендаций.

До появления этих элементов Frontier Model Forum корректнее оценивать как обещание координации между конкурентами, а не как готовую систему надзора. Для пользователей и разработчиков главным результатом будут не заявления участников, а опубликованные тесты, стандарты, отчёты об инцидентах и возможность независимой проверки.

Источники