代理合同
Policy engine for AI agents.
Every action checked. Every limit enforced. Every breach recorded. Always.
Problems Solved · Quickstart · How It Works · Benchmarks · Install · API · Papers
______________________________________________________________________
每个AI代理都不受控制。
克劳德可以超过您的API预算。GPT可以绕过审批门。你的副驾驶可能会在没有人注意到的情况下违反合规规则。 每一个行动都是在没有监督的情况下发生的。
当前的修复程序不起作用。手动策略检查已被遗忘。速率限制存在于代理无法检查的应用程序代码中。审批工作流需要外部服务。合规义务在电子表格中得到跟踪。违规行为不会被发现,直到为时已晚。
代理合同 在单个二进制文件中建模策略、风险限额、批准、条件、义务和违规行为 .acon 文件。不是“添加配置文件”。您的代理有 治理引擎 --行为约束、预算执行、审批门和违规跟踪——所有这些都是结构化的,都可以在微秒内查询。
已解决的问题(请先阅读)
- 问题: 代理在没有策略约束的情况下运行,可以采取任何行动。
解决了的: 类型化策略(allow/dedeny/require_approval/audit-only)通过亚毫秒级的评估来强制执行行为规则。
- 问题: 对资源预算或速率限制没有运行时意识。
解决了的: 具有实时跟踪和阈值警报的定量风险限制。
- 问题: 高风险的行为是在没有人参与的情况下发生的。
解决了的: 具有请求/决定生命周期和审计跟踪的结构化审批工作流。
- 问题: 合规义务被非正式地跟踪,错过了最后期限。
解决了的: 具有自动逾期检测功能的截止日期跟踪义务。
- 问题: 违反政策的行为未被发现和记录。
解决了的: 使用预知和考古工具对违规记录进行严重程度分类。
from agentic_contract import ContractEngine
engine = ContractEngine("agent.acon")
# Your agent is governed
engine.policy_add("No production deploys on Friday", scope="global", action="deny")
engine.risk_limit_set("API spend", max_value=100.0, limit_type="budget")
# Session 47 -- months later, same governance:
result = engine.policy_check("deploy") # Check before acting
status = engine.risk_limit_check("API spend", 5) # Check budget headroom
report = engine.stats() # Full governance overview操作可靠性命令(CLI):
acon policy list # All active policies
acon limit list # Current limit usage
acon obligation check # Overdue obligations
acon violation list --severity critical # Critical breaches
acon stats # Full summary______________________________________________________________________
MCP工具(22核+16高级功能)
核心工具
| 类别 | 工具 | 描述 |
|---|---|---|
| 合同 | contract_create | 在代理或代理与用户之间创建新合同 |
contract_sign | 签订合同表示接受 | |
contract_verify | 验证合同的有效性和签名链 | |
contract_list | 列出带有可选状态过滤器的合同 | |
contract_get | 通过ID获取特定合同 | |
| 政策 | policy_add | 添加管理代理行为的策略规则 |
policy_check | 检查当前策略是否允许某个操作 | |
policy_list | 列出具有可选范围筛选器的活动策略 | |
| 风险 | risk_limit_set | 为资源或操作设置风险限制阈值 |
risk_limit_check | 检查行动是否会超过风险限额 | |
risk_limit_list | 列出所有当前值的风险限额 | |
| 批准 | approval_request | 请求批准受控行动 |
approval_decide | 批准或拒绝待处理的批准请求 | |
approval_list | 列出带有可选状态过滤器的审批请求 | |
| 条件 | condition_add | 添加条件执行规则 |
condition_evaluate | 评估是否满足操作条件 | |
| 义务 | obligation_add | 添加代理人必须履行的义务 |
obligation_check | 检查债务状态 | |
| 违反 | violation_list | 使用可选的严重性筛选器列出记录的违规行为 |
violation_report | 报告违反合同或政策的行为 | |
| 上下文 | contract_context_log | 记录合同行动背后的意图和背景 |
| 统计 | contract_stats | 获取合同存储的汇总统计信息 |
高级工具(16)
| 工具 | 说明 |
|---|---|
policy_omniscience | 分析影响代理的所有策略 |
risk_prophecy | 在发生风险限额违规之前进行预测 |
approval_telepathy | 预测拟议行动的批准路径 |
obligation_clairvoyance | 预测未来债务状态和截止日期 |
violation_precognition | 预测计划行动的违规概率 |
contract_crystallize | 根据意图描述生成完整的合同 |
policy_dna_extract | 提取政策演变的遗传模式 |
trust_gradient_evaluate | 评估代理动作对的信任梯度 |
collective_contract_create | 创建多方治理契约 |
temporal_contract_create | 创建具有治理级别演变的合同 |
contract_inheritance_create | 建立父子策略继承 |
smart_escalation_route | 智能地将违规行为发送给正确的审批人 |
violation_archaeology_analyze | 分析历史违规模式 |
contract_simulation_run | 模拟各种场景下的合同行为 |
federated_governance_create | 跨域创建联合治理 |
self_healing_contract_create | 创建适应违规模式的合同 |
一旦连接,LLM可以执行政策、跟踪预算、管理审批、监控义务和调查违规行为——所有这些都有相同的支持 .acon 二进制文件。
______________________________________________________________________
基准测试
| 操作 | 延迟 | 注意事项 |
|---|---|---|
| 单一政策评估 | 0.03毫秒 | 基于哈希的作用域查找 |
| 风险限额检查 | 0.04毫秒 | 直接比较 |
| 批准请求创建 | 0.05毫秒 | UUID+插入 |
| 逾期检查义务 | 0.02毫秒 | 时间戳比较 |
| 违规报告 | 0.04毫秒 | 附加+分类 |
| 1K政策评估 | 0.3毫秒 | 带示波器滤波器的线性扫描 |
| 10K政策评估 | 2.9毫秒 | 全引擎遍历 |
| 保存10K个实体 | 24毫秒 | 二进制序列化+BLAKE3校验和 |
| 加载10K个实体 | 18毫秒 | 内存映射文件读取 |
| 统计计算 | 0.01毫秒 | 预索引计数器 |
所有测量均在Apple M系列、单线程、冷缓存上进行。这 .acon 该格式使用固定大小的记录和BLAKE3校验和——没有JSON解析,没有查询计划开销。
______________________________________________________________________
为什么代理合同
治理是一个图表,而不是一个清单。 当你追踪 *为什么* 一个动作被拒绝,你跟着一条链:违规← 违反政策← 超出风险限额← 从未批准。这就是图形导航。简单的允许/拒绝规则永远无法重建推理。
一个文件。真正便携。 你的整个治理状态是一个单一的 .acon 文件。复制它。备份它。版本控制。没有云服务,没有API密钥,没有供应商锁定。
任何法学硕士,任何时候。 今天从克劳德开始。明天切换到GPT。明年改用本地模式。相同的合同文件。治理规则与代理一起传播,而不是与提供者一起传播。
自我疗愈。 当政策冲突或世界条件发生变化时,自愈合同制度会提出修正案。旧政策、新政策和修订链都被保留以供审计。
六种实体类型。 不仅仅是政策。策略、风险限制、审批工作流、条件、义务和违规——每种都有类型化的生命周期管理。四种策略操作(允许/拒绝/要求批准/仅审核),四种风险限额类型(费率/阈值/预算/计数),四个违规严重程度(信息/警告/严重/致命)。
______________________________________________________________________
安装
一个衬垫 (桌面配置文件):
curl -fsSL https://agentralabs.tech/install/contract | bash安装配置文件:
# Desktop (configures Claude Desktop, Cursor, Windsurf)
curl -fsSL https://agentralabs.tech/install/contract/desktop | bash
# Terminal-only (no desktop config writes)
curl -fsSL https://agentralabs.tech/install/contract/terminal | bash
# Remote/server hosts
curl -fsSL https://agentralabs.tech/install/contract/server | bash包装经理
# npm
npm install @agenticamem/contract
# pip
pip install agentic-contract
# cargo
cargo install agentic-contract-cli agentic-contract-mcp独立担保: 代理合同独立运作。不需要其他Agentra组件。
______________________________________________________________________
快速入门
CLI--通过4个命令实施治理
# Add a deny policy
acon policy add "No production deploys on Friday" --scope global --action deny
# Set a budget limit
acon limit set "API spend" --max 100.0 --type budget
# Add an obligation with a deadline
acon obligation add "Submit compliance report" \
--description "Weekly compliance summary" \
--deadline "2026-03-07T17:00:00Z"
# Check current governance state
acon statsPython SDK——5行受管代理
from agentic_contract import ContractEngine
engine = ContractEngine("agent.acon")
engine.policy_add("Rate limit API calls", scope="global", action="deny")
engine.risk_limit_set("API calls per minute", max_value=60, limit_type="rate")
print(engine.policy_check("call external API")) # Check before actingMCP——让克劳德执行合同
User: "Deploy the staging build to production"
Claude: Let me check the governance policies first.
→ policy_check("deploy to production")
→ Result: RequireApproval
This action requires approval. Let me create an approval request.
→ approval_request(rule_id, "Deploy staging to production", "claude-agent")
→ Waiting for human approval...______________________________________________________________________
MCP服务器
任何兼容MCP的客户端都可以即时访问运行时治理。 这 agentic-contract-mcp 板条箱暴露了整个ContractEngine 模型上下文协议 (JSON-RPC 2.0通过标准输入)。
cargo install agentic-contract-mcp配置Claude桌面
增添 ~/Library/Application Support/Claude/claude_desktop_config.json:
{
"mcpServers": {
"agentic-contract": {
"command": "agentic-contract-mcp",
"args": ["serve"]
}
}
}零配置:默认为~/.agentic/contract.acon.用覆盖"args": ["--path", "/path/to/contract.acon", "serve"].
配置VS代码/光标
增添 .vscode/settings.json:
{
"mcp.servers": {
"agentic-contract": {
"command": "agentic-contract-mcp",
"args": ["serve"]
}
}
}LLM能得到什么
| 类别 | 计数 | 示例 |
|---|---|---|
| 工具 | 38 | policy_add, policy_check, risk_limit_set, approval_request, violation_report, contract_crystallize ... |
| 资源 | 4 | acon://contract/stats, acon://contract/policies, acon://contract/violations ... |
| 提示 | 4 | contract_review, contract_setup, contract_audit, contract_risk_assessment |
服务器模式
对于云/服务器部署,设置身份验证令牌:
export AGENTIC_TOKEN="$(openssl rand -hex 32)"
agentic-contract-mcp serve______________________________________________________________________
常见工作流
行动前政策检查
1. policy_check("deploy to production")
2. If denied → stop, report violation
3. If require_approval → approval_request(...)
4. If allowed → proceed预算控制代理人
1. risk_limit_set("API spend", max=100, type="budget")
2. Before each call: risk_limit_check("API spend", 0.05)
3. If exceeded → violation_report(...)合规义务
1. obligation_add("Submit weekly report", deadline="2026-03-07T17:00:00Z")
2. Periodically: obligation_check()
3. On overdue → violation_report(...)______________________________________________________________________
运作原理
AgenticContract将所有治理数据存储为 类型化实体 以自定义二进制格式。实体代表治理原语(政策、风险限制、批准、条件、义务、违规)。该引擎在运行时评估策略、跟踪限制并记录违规行为。
为了提高性能和安全性,核心运行时是用Rust编写的。所有州都住在一个便携式 .acon 二进制文件——没有外部数据库,没有托管服务。MCP服务器通过JSON-RPC stdio公开了完整的引擎。
______________________________________________________________________
治理模式的详细内容:
实体 是治理原语——六种类型:
| 类型 | 内容 | 示例 |
|---|---|---|
| 政策 | 行为约束 | “周五没有生产部署”(拒绝,全局范围) |
| 风险限额 | 量化边界 | “API支出”(预算,最高100美元,当前47.50美元) |
| 审批规则 | 高风险行动的大门 | “生产部署需要团队领导批准” |
| 条件 | 先决条件检查 | “部署前必须通过测试”(阈值条件) |
| 义务 | 跟踪承诺 | “在3月7日前提交合规报告”(待定,截止日期) |
| 违反 | 违规记录 | “14:32时超过速率限制”(严重程度) |
政策行动 --四种类型: allow · deny · require_approval · audit_only
风险限额类型 --四种类型: rate · threshold · budget · count
违规严重程度 --四个级别: info · warning · critical · fatal
File format details
+-------------------------------------+
| HEADER 64 bytes | Magic(ACON) . version . flags . entity counts . timestamps
+-------------------------------------+
| POLICY TABLE fixed-size rows | id . label . scope . action . active . conditions . tags
+-------------------------------------+
| RISK LIMIT TABLE fixed-size rows | id . label . type . current . max . window
+-------------------------------------+
| APPROVAL TABLE fixed-size rows | rules . requests . decisions
+-------------------------------------+
| CONDITION TABLE fixed-size rows | id . label . type . expression
+-------------------------------------+
| OBLIGATION TABLE fixed-size rows | id . label . status . deadline . assignee
+-------------------------------------+
| VIOLATION TABLE fixed-size rows | id . description . severity . actor . timestamp
+-------------------------------------+
| CHECKSUM BLAKE3 | Integrity verification
+-------------------------------------+二进制格式使用 b"ACON" 魔术字节、用于O(1)实体访问的固定大小记录和用于完整性的BLAKE3校验和。没有JSON解析开销。没有外部服务。即时访问。
______________________________________________________________________
部署模型
- 默认情况下为独立: AgenticContract可独立安装和操作。与AgentMemory或其他姐妹的整合是可选的,从来不是必需的。
- 默认情况下,本地优先: 所有治理数据都存在于一个单一的
.acon文件系统上的二进制文件。
| 区域 | 默认行为 | 控件 |
|---|---|---|
| 文件位置 | ~/.agentic/contract.acon | ACON_PATH=/custom/path.acon |
| 服务器身份验证 | 服务器模式下需要 | AGENTIC_TOKEN= |
| 传输 | stdio(JSON-RPC 2.0) | agentic-contract-mcp serve |
| 帧大小限制 | 8 MiB最大消息 | MAX_CONTENT_LENGTH_BYTES |
| JSON-RPC版本 | 严格2.0验证 | 拒绝1.0和无效版本 |
| 策略范围 | 全局、会话或代理 | 每个策略范围分配 |
______________________________________________________________________
验证
| 套件 | 测试 | |
|---|---|---|
| 锈芯发动机 | 33 | 所有6种实体类型的单元测试+SDK trait impls |
| 发动机提前应力 | 55 | 全部16种高级功能+大型数据集+错误路径 |
| 现有应力/边缘情况 | 14 | 边界条件、Unicode、并发性 |
| MCP服务器压力 | 80 | 所有38个工具、协议合规性、传输、并发性 |
| 服务器压力 | 30 | 提示、资源、传输边缘案例、身份验证 |
| CLI集成 | 41 | 所有子命令、错误参数、持久性、工作流 |
| 边缘案例先进 | 29 | MCP质量标准合规性 |
| MCP库单元测试 | 6 | 传输和JSON-RPC验证 |
| 总计 | 288 | 全部通过 |
一篇研究论文:
______________________________________________________________________
存储库结构
这是一个Cargo工作区monorepo,包含核心库、MCP服务器、CLI和FFI绑定。
agentic-contract/
├── Cargo.toml # Workspace root
├── crates/
│ ├── agentic-contract/ # Core library (policy engine, file format, advanced capabilities)
│ ├── agentic-contract-mcp/ # MCP server (22 core + 16 advanced tools)
│ ├── agentic-contract-cli/ # CLI binary: acon (policy/limit/approval/obligation/violation)
│ └── agentic-contract-ffi/ # FFI bindings (C header + shared library)
├── python/ # Python SDK (PyPI: agentic-contract)
├── npm/wasm/ # WebAssembly bindings
├── paper/ # Research paper (Paper I: policy engine)
├── scripts/ # Install, CI, and guardrail scripts
├── docs/ # Documentation (public pages, ecosystem kit)
└── .github/workflows/ # CI/CD (build, test, release, guardrails)运行测试
# All workspace tests (unit + integration + stress)
cargo test --workspace
# Core engine tests only
cargo test -p agentic-contract
# MCP server stress tests
cargo test -p agentic-contract-mcp --test phase1_mcp_stress
# CLI integration tests
cargo test -p agentic-contract-cli --test cli_integration
# Guardrails
bash scripts/check-canonical-sister.sh______________________________________________________________________
隐私与安全
- 所有合同数据都保留在本地 在你的
.acon文件——没有云,没有遥测,没有网络调用 - 服务器模式要求显式身份验证 通过
AGENTIC_TOKEN环境变量 - MCP传输硬化 具有内容长度帧和8 MiB消息限制
- 二进制格式包括BLAKE3校验和 用于完整性验证
- 运行时没有外部依赖关系 --发动机是独立的
- 向以下人员报告漏洞:security@agentralabs.tech
贡献
看 贡献.md 用于开发设置和指南。所有捐款都需要:
cargo fmt --all -- --checkcargo clippy --workspace --all-targets -- -D warningscargo test --workspacebash scripts/check-canonical-sister.sh
许可证
麻省理工学院——见 许可证.
______________________________________________________________________
Built by Agentra Labs
