Skip to main content
agent Governance OS
有规 · 有矩
看 MAREF 如何工作

从快速了解开始,一步步深入 MAREF 的治理世界。

你的 Agent 正在替你闯祸——
而你根本不知道。

88% 的企业过去一年经历过 AI Agent 安全事件。不是 Agent 不听话,而是没有人给它立规矩。MAREF 是多智能体系统的「治理操作系统」——让每个 Agent 知道该做什么,不该做什么。

REAL-WORLD AI AGENT INCIDENTS CRITICAL META · AI Alignment 我的 Agent 删了整箱邮件 Summer Yue 明确要求 Agent "等我确认再执行"。 Agent 上下文压缩丢失指令, 批量删除数百封邮件, 无视三次 "STOP" 命令。 她最后跑着去拔了网线。 IMPACT 数百封 3次 拔网线 —— 邮件被删 STOP 无视 物理断网 HIGH CURL · Open Source 关闭 7 年漏洞悬赏 AI 生成的漏洞报告中 只有 5% 是真实的。 维护者直接砍掉整个项目 而不是筛选 AI 垃圾。 IMPACT 7 年 5% 项目关闭 —— 漏洞悬赏历史 真实报告率 功能 WARNING GITHUB · CodeRabbit 45% 的 AI 代码 带着漏洞上线 CodeRabbit 扫描 470 个 PR: AI 代码严重缺陷 是人工的 1.7 倍。 63% 的开发者说 修 AI 代码比自己写还慢。 IMPACT 470 PR 1.7x 63% —— 扫描样本量 缺陷倍数 开发者抱怨 你的 Agent 在闯祸——而你不知道
你的数据不会离开你的设备 前端本地扫描 — 隐私优先 开源可审计 — 100% 透明 不上传原始配置 — 自动脱敏
不是未来风险。是正在发生的事故。

你的 Agent 已经在失控。

这不是假设。这是正在发生在真实公司的事。

Meta 对齐总监:我的 Agent 删了整箱邮件
curl 关闭 7 年漏洞悬赏——AI 垃圾淹没了真实信号
GitHub:45% 的 AI 代码带着漏洞上线

问题不是 'AI 会不会安全'。是 '当你的 Agent 闯祸的时候,谁拦得住它?'。

治理操作系统

装一个 MAREF,就像给 Agent 装了 8 道安检门。

你的 Agent 每做一个动作,MAREF 自动过检。

你担心的事 MAREF 怎么解决 你的感受
Agent 突然删文件 连续 3 次异常自动熔断 + 30 秒冷却 「它刚想动手,就被按住了」
Agent 乱调用 API 身份验明 → 权限核对 → 行为审计,0.3 秒 「我甚至感觉不到它在检查」
不知道 Agent 在干什么 不可变日志:每一步操作签名留痕 「翻开日志,它干过什么一清二楚」
合规检查过不了 国密 SM2/SM3/SM4,等保 2.0 就绪 「审计来了,报告直接导出」

以前你盯着 Agent 10 小时怕它闯祸。
现在你可以去睡觉。

不是买工具,
是买「下一个时代的话语权」。

当所有人都在造 Agent 的时候,真正值钱的不是 Agent 本身,而是让 Agent 不敢乱来的规矩。

全球唯一治理原生的 Agent 框架

不是安全附加组件。治理就是产品本身。

TLA+ 形式化验证

Lyapunov 收敛 + Sperner 完备性——不是「我们相信安全」,是「我们证明了安全」。

国密级密码学合规

SM2/SM3/SM4,等保 2.0 就绪。审计来了,报告直接导出。

别人在造 Agent,你在造 Agent 的「交通规则」。

降低门槛

觉得 MAREF 太复杂?先从 Lite 开始。

不需要你写代码、配状态机。一条命令,即刻治理。

docker run maref/lite

一条命令启动

12 条预配置治理规则

开箱即用

自动拦截高风险操作

不需要你定义「什么是高风险」

与风险扫描结果联动

体检发现问题 → Lite 自动针对性加固

六层架构 — 治理在中心。

MAREF six-layer architecture with Governance at the center

应用层

/ Application

多智能体框架集成层,兼容任何智能体框架。

LangGraphCrewAIAutoGen

编排层

/ Orchestration

任务分解与跨智能体分布式事务协调。

TaskDAGSaga5D Scheduler

治理层

/ Governance

治理优先门控。所有智能体动作执行前必经此层。

Gray Code FSMPolicyDecisionTreeCircuitBreaker

安全层

/ Safety

截图脱敏、输入过滤、文件沙箱、剪贴板清洗。

8-Layer DefenseThreat DetectionAuto-Lock

可观测层

/ Observability

完整遥测、不可变操作记录和实时监控。

OpenTelemetryAudit BusTelemetry

基础设施层

/ Infrastructure

部署基座。Sidecar 注入、K8s 原生、Serverless 就绪。

SidecarKubernetesServerless
实时:治理生产智能体

每个工具调用。每个决策。签名验证。

MAREF 位于你的智能体和它们接触的一切之间—— 拦截威胁、密码学签名每个决策、实时演进防御策略。

纵深防御

8 层纵深防御架构

红色攻击箭头从左进入,逐层穿透 — 在第 5 层安全门控被拦截

PROTECTED01输入净化02工具调用审计03权限检查04沙箱隔离05安全门控06策略决策树07威胁检测08遥测审计
治理状态机

Gray Code 有限状态机

每步跳转汉明距离 = 1,数学可验证的治理状态转换

初始000000引导000001加载000011校验000010认证000110运行000111监控000101演进000100检查点001100终止100000Current: 000000当前状态跳转路径汉明距离 = 1吸收态 HALT
MAREF 标准与行业标准

为什么选择 MAREF?

7 个关键维度 × 6 个框架的横评

维度
MAREF
MAREF v0.30.0
LangGraph
LangGraph
CrewAI
CrewAI
AutoGen
Microsoft AutoGen
OpenAI
OpenAI Agents SDK
Anthropic
Anthropic Tool Use
Manual
Manual Governance
形式化验证
TLA+/Coq 正确性证明
10 4 3 5 3 3 2
纵深防御
多层安全架构
10 5 4 5 4 4 3
零信任架构
智能体间无隐式信任
9 3 2 3 4 4 5
Gray Code 状态机
汉明距离=1 治理
10 1 1 1 1 1 1
自演进
Lyapunov 收敛证明
10 2 3 4 1 1 1
国密算法
SM2/SM3/SM4 合规
9 1 1 1 2 2 3
全链路可观测
OpenTelemetry + 不可变审计
9 6 5 6 5 4 2
收敛性

Lyapunov 收敛性证明

FNR -60%,200 轮自演进后的数学可证收敛

V(x)=xᵀPx, V̇(x)≤-α‖x‖² Lyapunov 函数保证指数级收敛
-60%
FNR 降幅
从 37% 降至 2%,漏报率几乎归零
数学可证
行为上界
Lyapunov 稳定性理论保证系统不会失控
每轮收敛
非经验调参
每次部署迭代都有向安全方向的数学保证
-96%
FPR 同步下降
从 26% 降至 1%,无安全盲区

Agent 已经在替你干活了。
MAREF 确保它不会替你闯祸。

$ pip install maref

开源 · 递归演进 · 生产就绪 · Apache 2.0 · 4,300+ 测试 · 82% 覆盖率