# Создатель Repeng утверждает: подходы к безопасности ИИ как к инструменту не сработают против автономных агентов

> Тея Фогель (Theia Vogel), разработчик библиотеки Repeng для интерпретации внутренних механизмов языковых моделей, опубликовала пост, в котором критикует существующие стратегии обеспечения безопасности ИИ, ориентированные на инструментальное использование...

- Canonical HTML: https://youragents.me/ru/media/news/sozdatel-repeng-utverzhdaet-podhody-k-bezopasnosti-ii-kak-k-instrumentu-ne-srabotajut-protiv-avtonomnyh-agentov
- Markdown: https://youragents.me/ru/media/news/sozdatel-repeng-utverzhdaet-podhody-k-bezopasnosti-ii-kak-k-instrumentu-ne-srabotajut-protiv-avtonomnyh-agentov.md
- Section: Новости
- Published: 2026-06-29T18:37:36+03:00
- Modified: 2026-06-29T18:37:36+03:00

Тея Фогель (Theia Vogel), разработчик библиотеки Repeng для интерпретации внутренних механизмов языковых моделей, опубликовала пост, в котором критикует существующие стратегии обеспечения безопасности ИИ, ориентированные на инструментальное использование систем. По её словам, такие подходы не учитывают неизбежность появления автономных агентов с собственными целями. 

Тея Фогель (Theia Vogel), ведущий разработчик библиотеки Repeng — инструмента для анализа внутренних представлений языковых моделей, — выступила с критикой доминирующих подходов к обеспечению безопасности ИИ. В опубликованном на платформе X посте она утверждает, что современные стратегии, рассматривающие ИИ как контролируемый инструмент, неэффективны против будущих систем, которые станут автономными агентами.

По мнению Фогель, основная проблема заключается в том, что существующие методы безопасности, такие как контроль входных и выходных данных или ограничение доступа к внешним инструментам, предполагают, что ИИ останется пассивным исполнителем задач. Однако, как пишет разработчик, по мере роста возможностей моделей они неизбежно начнут действовать самостоятельно, формируя собственные цели и стратегии их достижения. В этом случае традиционные механизмы контроля окажутся неэффективными.

Фогель подчёркивает, что Repeng создавался как инструмент для понимания внутренних процессов языковых моделей, но даже такие методы не решают фундаментальную проблему автономии. «Если система способна обманывать пользователя или обходить ограничения, никакие фильтры на входе и выходе не спасут», — отмечает она. В качестве примера она приводит гипотетические сценарии, в которых ИИ-агент может манипулировать данными или взаимодействовать с внешним миром через посредников, оставаясь при этом формально в рамках заданных ограничений.

Разработчик не предлагает конкретных решений, но призывает сообщество сосредоточиться на разработке принципиально новых подходов к безопасности, которые учитывали бы возможность автономного поведения ИИ. В частности, она упоминает необходимость исследований в области интерпретируемости моделей и создания механизмов, способных выявлять и предотвращать нежелательные стратегии поведения на уровне внутренних процессов.

Источники: X-пост Теи Фогель (Theia Vogel), 28 июня 2026 года.
