SDK 将智能体运行拆分为 Harness 层(控制流、模型调用、工具路由)和 Compute 层(文件读写、命令运行、依赖安装)。敏感凭证和 API Key 始终停留于 Harness 层,即使沙箱被完全控制也不会泄露。
通过沙箱和工作区清单将智能体限制在明确授权的文件和工具范围内,结合标准 Unix 权限模型,防止智能体越权访问相邻路径或发起不受约束的网络调用。
输入、输出和工具三级 Guardrails 与人在回路机制相结合,对高风险操作进行实时拦截或暂停审批,确保智能体行为在安全边界内。
OpenAI 明确建议以应对提示注入和数据外泄的假设来设计智能体系统,通过分离编排与计算、外部化状态等方式降低攻击面。