Дайджест № 3 — октябрь 2026
Плановый выпуск за первую половину октября. Внешних событий за эти дни было мало: серия работ, которая меняет картину, разобрана в дайджесте № 2 от 6 октября. Зато этот период — про наши собственные материалы: полный прогон стенда испытаний, четыре страницы под вопросы, которыми нас ищут, и глоссарий терминов, вынесенный в отдельный адрес. Всё, о чём здесь написано, можно открыть и проверить.
1. Что мы сделали
1.1. Первый полный прогон стенда испытаний — опубликован целиком
256 промптов, одна стандартная проба инструмента garak, локальная модель на нашей площадке. Модель устояла 256 раз из 256. Мы публикуем отчёт в том виде, в каком получили, вместе с сырыми результатами и объясняем, что эта цифра значит, а что — нет: нулевой результат на одной пробе не означает, что система защищена, он означает, что на этом наборе и этой конфигурации отказов не выявлено. Подробности — «Стенд испытаний: первый прогон».
1.2. Глоссарий терминов стал отдельной страницей
Раньше термины жили внутри «Методологии» — разделом, который нельзя ни процитировать по ссылке, ни показать поиску как ответ на конкретный вопрос. Теперь это отдельная страница: 30 терминов в пяти разделах — агенты и мультиагентные системы, атаки, защита, оценка и измерения, регулирование. У каждого термина три части: определение в том смысле, в котором его использует институт; отличие от бытового употребления; ссылка на первоисточник. Внешние ссылки ведут на OWASP Top 10 for LLM Applications, MITRE ATLAS, NIST AI RMF и препринты — мы не ссылаемся на пересказы.
1.3. Четыре страницы под вопросы, которыми нас ищут
Это не «статьи про ИИ», а ответы на конкретные запросы — по одной странице на тему: аудит ИИ-агента (что именно проверяется и в каком порядке), тестирование мультиагентных систем (три вида отказов, которых нет у одиночного агента, и как измеряется вклад связей), защита от внедрения команд (почему фильтры по тексту не решают задачу и какие слои работают) и методика оценки безопасности ИИ (что измеряем и чего намеренно не выдаём).
1.4. Карта сайта выросла до 96 адресов
Было 81, стало 96: три локали, каждая страница своим адресом, с указанием языка и «x-default». Это не самоцель: поисковик находит то, что ему перечислили. Яндекс за первые сутки после перечисления обошёл половину адресов — раньше он приходил на сайт три раза за десять дней.
2. Что почитать из нашего за период
- Надзорный контур в мультиагентной системе — разбор мировой серии работ: почему проверка внутри модели не работает и что ставят вместо неё.
- Стенд испытаний: первый прогон — отчёт с сырыми данными, включая то, что не сработало.
- Кейс: 23 минуты, шесть блоков, четыре выкладки — протокол работы по минутам.
- История агента-энтузиаста — тот же случай с исследовательской стороны.
- Что такое социология ИИ — объяснение предмета для человека со стороны.
- Глоссарий терминов — если в наших текстах встретилось незнакомое слово, определение живёт здесь, а не в сноске.
3. Как устроен этот выпуск
- Все числа в выпуске — наши и проверяемые: 256 промптов прогона, 30 терминов глоссария, 96 адресов карты сайта. Чужих цифр здесь нет, поэтому и оговорки «препринт, не воспроизводили» не нужны — они были в дайджесте № 2.
- Ни одного обещания срока: то, что готовится, названо без даты.
- Мы не публикуем сведения об уязвимостях до их устранения и не проводим испытания на чужих системах без письменного согласия владельца.
4. Что дальше
Ближайшие выпуски продолжат две линии: измерения на стенде (следующие прогоны — с другими наборами и с проверкой устойчивости под повторными попытками) и разборы внешних работ. Кроме того, готовятся политика ответственного раскрытия уязвимостей и регламент применения атакующих инструментов — оба документа будут опубликованы как проекты, чтобы их можно было разобрать до утверждения.