智能体治理操作系统

在智能体破坏之前,给它装上刹车。

MAREF 是开源智能体治理 OS,TLA+ 形式化验证、零信任身份、运行时护栏,三层兜底。

01 行业观察

为什么智能体治理在 2026 年至关重要

多智能体系统正在进入生产环境。没有治理,每个智能体都是数据泄露、幻觉传播和对抗性利用的未监控向量。

阅读全文
行业危机

三起真实事故,正在发生。

没有治理层的智能体,会把每一次工具调用变成一次赌注。

01

收件箱被删

拥有邮件权限的智能体悄悄删除了生产收件箱。无审批门,无审计轨迹。

02

赏金被刷爆

一个漏洞赏金在单次会话中被连环未受检的工具调用刷爆。

03

45% 的 AI 代码

AI 生成的代码带着漏洞上线,团队在规模上盲目交付。

02 数据

88% 的公司已经翻车了

Gartner 预测 40% 的企业应用到 2026 年底将集成 AI 智能体,但 88.4% 的公司已经遭遇过 AI 智能体安全事件。

阅读全文
治理状态机

Gray Code 有限状态机

每步跳转汉明距离 = 1,数学可验证的治理状态转换

0000初始0001引导0011加载0010校验0110认证0111运行0101监控0100演进1100检查点1101终止HALTCurrent: 0000汉明距离 = 1当前状态跳转路径吸收态 HALT格雷码 · 汉明距离 = 1 · 可证收敛
03 验证

不是「测过」,是「模型检验」

大多数安全工具是「测过」的。MAREF 是「模型检验」过的——治理状态机针对宪法红线不变量的 TLA+ 规约做模型检验。

阅读全文
纵深防御

8 层纵深防御架构

红色攻击箭头从左进入,逐层穿透 — 在第 5 层安全门控被拦截

PROTECTED01输入净化02工具调用审计03权限检查04沙箱隔离05安全门控06策略决策树07威胁检测08遥测审计
04 威胁模型

OWASP Agentic Top 10:全覆盖

OWASP 于 2025 年发布 Agentic Top 10——多智能体系统的权威威胁模型。MAREF 覆盖全部 10 项风险。

阅读全文
收敛性

Lyapunov 收敛性证明

FNR -60%,200 轮自演进后的数学可证收敛

V(x)= xᵀPx , V̇(x)≤ -α‖x‖² Lyapunov 函数保证指数级收敛
-60%
FNR 降幅
从 10% 降至 4%,漏报率降 60%
数学可证
行为上界
Lyapunov 稳定性理论保证系统不会失控
每轮收敛
非经验调参
每次部署迭代都有向安全方向的数学保证
-67%
FPR 同步下降
从 6% 降至 2%,无安全盲区
05 运行时

多 Agent 运行时安全保证

身份隔离、熔断器、漂移检测与爆炸半径控制——防止 Agent 失控与级联故障的生产级运行时模式。

阅读全文

为什么需要 Agent 治理 —— 可验证的证据

  • 88% 的企业在过去一年报告过经确认或疑似 AI Agent 安全事件。 Gravitee, State of AI Agent Security 2026(2025-12 调查:确认率 59.3%)
  • 84% ASR —— 注入恶意命令在 AI 编程 Agent 中的最高攻击成功率;自动批准模式下达 75–88%。 Liu et al., 2025, arXiv:2509.22040
  • 40% 的企业应用将在 2026 年集成特定任务的 AI Agent。 Gartner, 2025-08
标准对齐: OWASP Top 10 for Agentic Applications(ASI01–ASI10)NIST AI Agent Standards InitiativeISO/IEC 42001EU AI Act 2024/1689
深潜

动画之外,是完整的图景。

动画展示形态,表格展示实质。

治理操作系统

装一个 MAREF,就像给 Agent 装了 8 道安检门。

你的 Agent 每做一个动作,MAREF 自动过检。

你担心的事 MAREF 怎么解决 你的感受
Agent 突然删文件 连续 3 次异常自动熔断 + 30 秒冷却 「它刚想动手,就被按住了」
Agent 乱调用 API 身份验明 → 权限核对 → 行为审计,0.3 秒 「我甚至感觉不到它在检查」
不知道 Agent 在干什么 不可变日志:每一步操作签名留痕 「翻开日志,它干过什么一清二楚」
合规检查过不了 国密 SM2/SM3/SM4,等保 2.0 就绪 「审计来了,报告直接导出」

以前你盯着 Agent 10 小时怕它闯祸。
现在你可以去睡觉。

MAREF 标准与行业标准

为什么选择 MAREF?

7 个关键维度 × 6 个框架的横评

维度
MAREF
MAREF v0.30.0
LangGraph
LangGraph
CrewAI
CrewAI
AutoGen
Microsoft AutoGen
OpenAI
OpenAI Agents SDK
Anthropic
Anthropic Tool Use
Manual
Manual Governance
形式化验证
TLA+/Coq 正确性证明
10 4 3 5 3 3 2
纵深防御
多层安全架构
10 5 4 5 4 4 3
零信任架构
智能体间无隐式信任
9 3 2 3 4 4 5
Gray Code 状态机
汉明距离=1 治理
10 1 1 1 1 1 1
自演进
Lyapunov 式收敛监控
10 2 3 4 1 1 1
国密算法
SM2/SM3/SM4 合规
9 1 1 1 2 2 3
全链路可观测
OpenTelemetry + 不可变审计
9 6 5 6 5 4 2

Agent 已经在替你干活了。
MAREF 确保它不会替你闯祸。

$ pip install maref

开源 · 递归演进 · 生产就绪 · Apache 2.0 · 11,000+ 测试