Специалист по безопасности искусственного интеллекта Дэвид Манхейм (David Manheim) опубликовал проект консенсусного заявления, призывающего к обязательной публикации репликационных пакетов при оценке ИИ-систем. Документ поддержали представители ведущих лабораторий и академических институтов.
Дэвид Манхейм, научный сотрудник Центра безопасности ИИ (Center for AI Safety) и приглашённый исследователь Оксфордского университета, выступил с инициативой по унификации подходов к оценке моделей искусственного интеллекта. В опубликованном проекте консенсусного заявления он предлагает ввести обязательное требование к публикации репликационных пакетов — наборов данных, кодов и методологий, позволяющих независимо воспроизвести результаты оценки.
По словам Манхейма, текущая практика оценки ИИ-систем страдает от отсутствия стандартизации и прозрачности. «Без возможности воспроизвести результаты любая оценка остаётся лишь мнением автора», — отмечается в документе. Проект заявления уже поддержали более 50 исследователей из Google DeepMind, Anthropic, Meta, а также ряда университетов, включая Стэнфорд и Кембридж.
Инициатива Манхейма направлена на решение проблемы, которая обострилась с ростом числа публикаций об уязвимостях и возможностях ИИ-моделей. В последние годы несколько громких заявлений о прорывах в области безопасности ИИ были опровергнуты после попыток независимой проверки. В частности, в документе упоминается случай с исследованием, утверждавшим о способности модели обходить защитные механизмы, которое позже не удалось воспроизвести.
Предложенный стандарт предполагает, что репликационные пакеты должны включать не только исходные данные и код, но и подробное описание процедуры оценки, включая параметры окружения и аппаратные требования. Авторы инициативы также предлагают создать репозиторий для хранения таких пакетов, чтобы облегчить доступ к ним для других исследователей.
В комментариях к проекту представители индустрии отмечают, что внедрение подобных стандартов может замедлить публикацию результатов, но повысит доверие к научным выводам. «Это необходимый шаг для превращения оценки ИИ из искусства в науку», — заявил один из соавторов заявления, сотрудник Google DeepMind.