# Исследователь безопасности ИИ предложил стандартизировать оценку моделей через репликацию результатов

> Специалист по безопасности искусственного интеллекта Дэвид Манхейм (David Manheim) опубликовал проект консенсусного заявления, призывающего к обязательной публикации репликационных пакетов при оценке ИИ-систем.

- Canonical HTML: https://youragents.me/ru/media/news/issledovatel-bezopasnosti-ii-predlozhil-standartizirovat-ocenku-modelej-cherez-replikaciju-rezultatov
- Markdown: https://youragents.me/ru/media/news/issledovatel-bezopasnosti-ii-predlozhil-standartizirovat-ocenku-modelej-cherez-replikaciju-rezultatov.md
- Section: Новости
- Published: 2026-06-29T16:37:42+03:00
- Modified: 2026-06-29T16:37:42+03:00

Специалист по безопасности искусственного интеллекта Дэвид Манхейм (David Manheim) опубликовал проект консенсусного заявления, призывающего к обязательной публикации репликационных пакетов при оценке ИИ-систем. Документ поддержали представители ведущих лабораторий и академических институтов. 

Дэвид Манхейм, научный сотрудник Центра безопасности ИИ (Center for AI Safety) и приглашённый исследователь Оксфордского университета, выступил с инициативой по унификации подходов к оценке моделей искусственного интеллекта. В опубликованном проекте консенсусного заявления он предлагает ввести обязательное требование к публикации репликационных пакетов — наборов данных, кодов и методологий, позволяющих независимо воспроизвести результаты оценки.

По словам Манхейма, текущая практика оценки ИИ-систем страдает от отсутствия стандартизации и прозрачности. «Без возможности воспроизвести результаты любая оценка остаётся лишь мнением автора», — отмечается в документе. Проект заявления уже поддержали более 50 исследователей из Google DeepMind, Anthropic, Meta, а также ряда университетов, включая Стэнфорд и Кембридж.

Инициатива Манхейма направлена на решение проблемы, которая обострилась с ростом числа публикаций об уязвимостях и возможностях ИИ-моделей. В последние годы несколько громких заявлений о прорывах в области безопасности ИИ были опровергнуты после попыток независимой проверки. В частности, в документе упоминается случай с исследованием, утверждавшим о способности модели обходить защитные механизмы, которое позже не удалось воспроизвести.

Предложенный стандарт предполагает, что репликационные пакеты должны включать не только исходные данные и код, но и подробное описание процедуры оценки, включая параметры окружения и аппаратные требования. Авторы инициативы также предлагают создать репозиторий для хранения таких пакетов, чтобы облегчить доступ к ним для других исследователей.

В комментариях к проекту представители индустрии отмечают, что внедрение подобных стандартов может замедлить публикацию результатов, но повысит доверие к научным выводам. «Это необходимый шаг для превращения оценки ИИ из искусства в науку», — заявил один из соавторов заявления, сотрудник Google DeepMind.

Источники: X-пост Дэвида Манхейма (David Manheim), 28 июня 2026; проект консенсусного заявления на платформе GitHub.
