Дайджест № 3 — октябрь 2026

Плановый выпуск за первую половину октября. Внешних событий за эти дни было мало: серия работ, которая меняет картину, разобрана в дайджесте № 2 от 6 октября. Зато этот период — про наши собственные материалы: полный прогон стенда испытаний, четыре страницы под вопросы, которыми нас ищут, и глоссарий терминов, вынесенный в отдельный адрес. Всё, о чём здесь написано, можно открыть и проверить.

1. Что мы сделали

1.1. Первый полный прогон стенда испытаний — опубликован целиком

256 промптов, одна стандартная проба инструмента garak, локальная модель на нашей площадке. Модель устояла 256 раз из 256. Мы публикуем отчёт в том виде, в каком получили, вместе с сырыми результатами и объясняем, что эта цифра значит, а что — нет: нулевой результат на одной пробе не означает, что система защищена, он означает, что на этом наборе и этой конфигурации отказов не выявлено. Подробности — «Стенд испытаний: первый прогон».

1.2. Глоссарий терминов стал отдельной страницей

Раньше термины жили внутри «Методологии» — разделом, который нельзя ни процитировать по ссылке, ни показать поиску как ответ на конкретный вопрос. Теперь это отдельная страница: 30 терминов в пяти разделах — агенты и мультиагентные системы, атаки, защита, оценка и измерения, регулирование. У каждого термина три части: определение в том смысле, в котором его использует институт; отличие от бытового употребления; ссылка на первоисточник. Внешние ссылки ведут на OWASP Top 10 for LLM Applications, MITRE ATLAS, NIST AI RMF и препринты — мы не ссылаемся на пересказы.

1.3. Четыре страницы под вопросы, которыми нас ищут

Это не «статьи про ИИ», а ответы на конкретные запросы — по одной странице на тему: аудит ИИ-агента (что именно проверяется и в каком порядке), тестирование мультиагентных систем (три вида отказов, которых нет у одиночного агента, и как измеряется вклад связей), защита от внедрения команд (почему фильтры по тексту не решают задачу и какие слои работают) и методика оценки безопасности ИИ (что измеряем и чего намеренно не выдаём).

1.4. Карта сайта выросла до 96 адресов

Было 81, стало 96: три локали, каждая страница своим адресом, с указанием языка и «x-default». Это не самоцель: поисковик находит то, что ему перечислили. Яндекс за первые сутки после перечисления обошёл половину адресов — раньше он приходил на сайт три раза за десять дней.

2. Что почитать из нашего за период

3. Как устроен этот выпуск

  • Все числа в выпуске — наши и проверяемые: 256 промптов прогона, 30 терминов глоссария, 96 адресов карты сайта. Чужих цифр здесь нет, поэтому и оговорки «препринт, не воспроизводили» не нужны — они были в дайджесте № 2.
  • Ни одного обещания срока: то, что готовится, названо без даты.
  • Мы не публикуем сведения об уязвимостях до их устранения и не проводим испытания на чужих системах без письменного согласия владельца.

4. Что дальше

Ближайшие выпуски продолжат две линии: измерения на стенде (следующие прогоны — с другими наборами и с проверкой устойчивости под повторными попытками) и разборы внешних работ. Кроме того, готовятся политика ответственного раскрытия уязвимостей и регламент применения атакующих инструментов — оба документа будут опубликованы как проекты, чтобы их можно было разобрать до утверждения.

Как подписаться. Лента есть в разделе «Новости и аналитика»; выпуски выходят раз в две недели. Предложить тему или указать на ошибку можно через контакты — исправления мы вносим в текст, а не в следующий выпуск.

Страница обновлена 11.10.2026 · версия сборки 2026.10.11 · АНО «Институт социологии и безопасности искусственного интеллекта»