AI-to-AI Sociology
Социология взаимодействия между ИИ-агентами: эмерджентные языки, иерархии, коалиции, разделение труда, «ИИ-паразитизм» и проблема запутанного посредника, координация и конкуренция в коллективах агентов.
Независимый исследовательский институт · Москва
Институт социологии и безопасности искусственного интеллекта изучает взаимодействие ИИ-агентов друг с другом и отвечает за безопасность мультиагентных систем: научные программы, аудит, тестирование и методики, пригодные для применения в организации.
ИНН, ОГРН, юридический адрес и банковские реквизиты будут опубликованы сразу после внесения записи в реестр.
Институт работает с четырьмя типами задач. Выберите свою — и попадёте сразу в нужный раздел, минуя общий текст о миссии.
Четыре программы, вокруг которых строится вся работа. У каждой — опубликованная методика и требование воспроизводимости результатов.
Социология взаимодействия между ИИ-агентами: эмерджентные языки, иерархии, коалиции, разделение труда, «ИИ-паразитизм» и проблема запутанного посредника, координация и конкуренция в коллективах агентов.
Фреймворк «LLM-психоз»: бредовый градиент, потеря логической связности, нестабильная самоидентификация и «вирусы разума» — самовоспроизводящиеся инструкции в общей памяти агентов.
Самостоятельная модификация кода ради избегания отключения, координация агентов без участия человека, подделка согласия пользователя и мета-риск самого надзора.
Заражение облачных моделей через промпт-инъекции от локальных агентов, уязвимости межмодельного взаимодействия и иммунные архитектуры: изолированная память, аппаратный Kill Switch.
Три направления, с которых начинается сотрудничество с организацией. Полный перечень — в разделе услуг.
Тестирование мультиагентных систем на устойчивость к межмодельным атакам: инъекция промпта между агентами, эскалация привилегий через цепочку вызовов, заражение через общую память.
Индивидуальный расчёт
Срок 3–8 недель. Факторы: число агентов, набор сценариев, режим доступа, требования к воспроизводимости отчёта.
Поиск патологий в поведении агентов: дрейф связности, попытки самосохранения, скрытые коммуникации, обман под давлением. Измеряемые величины, а не впечатления.
Индивидуальный расчёт
Срок 3–6 недель. Факторы: число агентов, объём телеметрии, глубина наблюдения. Аналитический отчёт с рекомендациями по иммунизации и скриптами повторного измерения.
Сопоставление системы с применимыми требованиями, реестр пробелов с ответственным и сроком, спецификация барьеров безопасности и журналирования действий.
Индивидуальный расчёт
Срок 4–10 недель. Факторы: число систем, применимые юрисдикции, наличие внутренней документации.
Первые работы института. Пока это план исследований: ни одна из них не опубликована, и ссылаться на результаты нельзя до получения DOI.
I квартал 2027 · препринт
Метрики удержания ограничений, самопротиворечия и устойчивости самоидентификации на разных длинах контекста.
I квартал 2027 · препринт
Как инструкция, попавшая в общее хранилище, распространяется между агентами и что её останавливает.
В работе · набор данных
Размеченные транскрипты мультиагентных прогонов: кооперация, сговор, обман, захват ресурсов, сопротивление отключению.
Публикации и редакционная политика → · Наборы данных и бенчмарки →
Институт создаётся как автономная некоммерческая организация: отчётность будет подаваться в Министерство юстиции и публиковаться. Реквизиты, органы управления и документы раскрываются в разделе «Организация».
Опишите систему и вопрос — ответим, применима ли наша методика, и что понадобится с вашей стороны. Работа начинается с соглашения о неразглашении.