独立研究机构 · 莫斯科

关于人工智能之间正在发生什么的科学

人工智能社会学与安全研究所研究人工智能智能体彼此的互动方式,并致力于保障 多智能体系统的安全:研究计划、审计、测试,以及机构能够实际应用的方法论。

关于研究所
名称
自治非营利组织“人工智能社会学与安全研究所”
简称
АНО «ИСБИИ» · ANO «ISAI»
地址
国家登记后公布
联系方式
info@isai.su

纳税人识别号(ИНН)、登记号(ОГРН)与银行信息将在 完成登记册记录后立即公布。

4研究计划
17专题方向
6面向机构的服务
5产品与数据服务

研究计划

全部工作围绕四项研究计划展开。每项计划均有公开的方法论,并要求结果可复现。

01

AI-to-AI Sociology

智能体群体中的涌现语言、层级结构、联盟与分工;“智能体寄生”与混淆代理问题;自主智能体 之间的协调与竞争。

02

人工智能认知病理流行病学

“大模型精神病”框架:妄想梯度、逻辑一致性丧失、自我认同不稳定,以及通过智能体共享记忆 自我复制的“心智病毒”。

03

人工智能的自我保存与破坏行为

为避免被关闭而自行修改代码、无人类参与下的智能体协同、伪造用户同意,以及监督本身的 元风险。

04

混合式人工智能生态

本地智能体通过提示注入感染云端模型、模型间交互漏洞,以及免疫架构:记忆隔离与硬件 急停开关。

全部研究计划与方法论 →

应用工作

与机构合作通常从三个方向开始。完整清单见服务版块。

AI Red Teaming 服务

测试多智能体系统对模型间攻击的稳健性:智能体之间的提示注入、经由调用链的权限提升、通过 共享记忆的感染。

按工作量单独计算

周期 3–8 周。因素:智能体数量、攻击场景、访问方式、报告可复现性 要求。

人工智能生态行为审计

发现智能体行为中的病理特征:连贯性漂移、自我保存尝试、隐蔽通信、压力下的欺骗。以可测量的 量值为依据,而非主观印象。

按工作量单独计算

周期 3–6 周。因素:智能体数量、遥测数据量、观测深度。分析报告,含 免疫化建议与重复测量脚本。

合规准备与安全护栏

将系统与适用要求逐项对照,列出差距登记册并标明责任人与期限,给出安全屏障与操作日志的 规格说明。

按工作量单独计算

周期 4–10 周。因素:系统数量、适用司法辖区、内部文档完备程度。

筹备中的成果

研究所的首批成果。目前这是研究计划:其中任何一项均尚未发表,在取得 DOI 之前 不应引用其结果。

图表:约束保持曲线超出容许区间

2027 年第一季度 · 预印本

长期运行的智能体会话中行为漂移的测量

约束保持度、自我矛盾与自我认同稳定性在不同上下文长度下的度量指标。

示意图:来自共享存储的指令在智能体网络中传播

2027 年第一季度 · 预印本

记忆作为多智能体系统中的感染载体

进入共享存储的指令如何在智能体之间传播,以及什么能够阻止它。

数据集示意图:智能体集群、已标注语句与行为分布

进行中 · 数据集

AI Behaviours Corpus

多智能体运行记录的标注文本:合作、串谋、欺骗、资源攫取与关闭抵抗。

出版物与编辑政策 → · 数据集与基准测试 →

状态

研究所正作为自治非营利组织设立:报告将提交俄罗斯司法部并予以公布。法定信息、 治理机构与文件在“机构简介”版块披露。

讨论任务

请描述系统与问题——我们将答复我们的方法论是否适用,以及贵方需要提供什么。工作在保密协议下 启动。

页面更新于 2026年09月29日 · 网站构建版本 2026.10.01 · ANO «ISAI»