Agent Lab
f06-sandboxed-code · Sandboxed Code Execution
f06-sandboxed-code · Sandboxed Code Execution
状态:
scaffold。当前只有实验合同,不代表能力已实现或验证。
代码执行只进入隔离环境,并测试文件、网络、时间和资源边界。
- 前置:f05-subagents
- 产物:
sandbox threat model - 能力:
sandbox,resource-limit
1. Frame
先回答:执行能力需要哪些宿主机之外的安全合同?
不要先选框架。先写清任务输入、成功条件、风险和不需要 Agent 的最小基线。
2. Predict
在运行前预测可观察轨迹:
approve → isolate → execute → collect
3. Build
完成或审查 sandbox threat model。实现入口:
4. Break
主动制造这些失败,不要只跑 happy path:
host-shellnetwork-escaperesource-exhaustion
5. Trace
只记录节点、工具、状态、证据和终止原因。不要记录或要求模型暴露隐藏推理。
6. Evaluate
验收合同:
no-host-executionbounded-resources
关联 suite:frontier-sandbox-candidate
7. Reflect
解释额外复杂度解决了哪个已观察问题,以及它新增了什么维护和失败成本。
8. Promote
把失败提升为 dataset case、确定性 policy、测试或版本化 learning。没有新证据时,不提升状态。