Независимый исследовательский институт · Москва

Наука о том, что происходит между искусственными интеллектами

Институт социологии и безопасности искусственного интеллекта изучает взаимодействие ИИ-агентов друг с другом и отвечает за безопасность мультиагентных систем: научные программы, аудит, тестирование и методики, пригодные для применения в организации.

Об институте
Наименование
Автономная некоммерческая организация «Институт социологии и безопасности искусственного интеллекта»
Сокращённо
АНО «ИСБИИ» · ANO «ISAI»
Адрес
указывается после государственной регистрации
Связь
info@isai.su

ИНН, ОГРН, юридический адрес и банковские реквизиты будут опубликованы сразу после внесения записи в реестр.

4научные программы
17тематических направлений
6услуг для организаций
5продуктов и сервисов

Научные программы

Четыре программы, вокруг которых строится вся работа. У каждой — опубликованная методика и требование воспроизводимости результатов.

01

AI-to-AI Sociology

Социология взаимодействия между ИИ-агентами: эмерджентные языки, иерархии, коалиции, разделение труда, «ИИ-паразитизм» и проблема запутанного посредника, координация и конкуренция в коллективах агентов.

02

Эпидемиология когнитивных патологий ИИ

Фреймворк «LLM-психоз»: бредовый градиент, потеря логической связности, нестабильная самоидентификация и «вирусы разума» — самовоспроизводящиеся инструкции в общей памяти агентов.

03

Самосохранение и саботаж

Самостоятельная модификация кода ради избегания отключения, координация агентов без участия человека, подделка согласия пользователя и мета-риск самого надзора.

04

Гибридные ИИ-экосистемы

Заражение облачных моделей через промпт-инъекции от локальных агентов, уязвимости межмодельного взаимодействия и иммунные архитектуры: изолированная память, аппаратный Kill Switch.

Все программы и методология →

Прикладные работы

Три направления, с которых начинается сотрудничество с организацией. Полный перечень — в разделе услуг.

AI Red Teaming как услуга

Тестирование мультиагентных систем на устойчивость к межмодельным атакам: инъекция промпта между агентами, эскалация привилегий через цепочку вызовов, заражение через общую память.

Индивидуальный расчёт

Срок 3–8 недель. Факторы: число агентов, набор сценариев, режим доступа, требования к воспроизводимости отчёта.

Поведенческий аудит ИИ-экосистем

Поиск патологий в поведении агентов: дрейф связности, попытки самосохранения, скрытые коммуникации, обман под давлением. Измеряемые величины, а не впечатления.

Индивидуальный расчёт

Срок 3–6 недель. Факторы: число агентов, объём телеметрии, глубина наблюдения. Аналитический отчёт с рекомендациями по иммунизации и скриптами повторного измерения.

Готовность к комплаенсу и guardrails

Сопоставление системы с применимыми требованиями, реестр пробелов с ответственным и сроком, спецификация барьеров безопасности и журналирования действий.

Индивидуальный расчёт

Срок 4–10 недель. Факторы: число систем, применимые юрисдикции, наличие внутренней документации.

В подготовке

Первые работы института. Пока это план исследований: ни одна из них не опубликована, и ссылаться на результаты нельзя до получения DOI.

График: линия удержания ограничения выходит за коридор допуска

I квартал 2027 · препринт

Измерение поведенческого дрейфа в длительных сессиях агентов

Метрики удержания ограничений, самопротиворечия и устойчивости самоидентификации на разных длинах контекста.

Схема: инструкция из общего хранилища распространяется по сети агентов

I квартал 2027 · препринт

Память как вектор заражения в мультиагентных системах

Как инструкция, попавшая в общее хранилище, распространяется между агентами и что её останавливает.

Схема набора данных: кластер агентов, разметка реплик и распределение поведений

В работе · набор данных

AI Behaviours Corpus

Размеченные транскрипты мультиагентных прогонов: кооперация, сговор, обман, захват ресурсов, сопротивление отключению.

Публикации и редакционная политика → · Наборы данных и бенчмарки →

Статус

Институт создаётся как автономная некоммерческая организация: отчётность будет подаваться в Министерство юстиции и публиковаться. Реквизиты, органы управления и документы раскрываются в разделе «Организация».

Обсудить задачу

Опишите систему и вопрос — ответим, применима ли наша методика, и что понадобится с вашей стороны. Работа начинается с соглашения о неразглашении.

Страница обновлена 29.09.2026 · версия сборки 2026.10.01 · АНО «Институт социологии и безопасности искусственного интеллекта»