// RESEARCH / AGENT SYSTEMS
AI Agent 研究
研究 Agent 的工具调用、权限边界、项目记忆和可治理交付,也持续构建真实可运行的 Agent 工具。
- 持续研究
- 当前状态
- 04
- 开放问题
- 04
- 公开证据
Agent 的价值不只在“能做事”,更在于每一步能被观察、暂停、验证和恢复。
已有 opendev、Claude Orbit 和 OpenSec 等公开原型;正在把安全边界、交付治理与项目级能力隔离串成同一条研究主线。
- 01
工具返回值本身不可信时,如何阻断间接提示注入?
- 02
MCP、Skills 与 Plugins 如何按项目执行最小权限装配?
- 03
长期任务如何保留记忆,同时避免错误和敏感信息持续污染?
- 04
成功率之外,怎样评估 Agent 的安全完成率与人工接管成本?
// LIMITS
现在还不能证明什么
- 目前公开项目以单机和个人工作流为主
- 尚缺跨任务、跨模型的一致评测集