← 返回项目总览

QUEST 01 / AGENT HARNESS

AES
本地 Agent Harness

给它一个具体开发目标,系统组织分析、编码、测试与修复,留下执行轨迹;遇到高风险动作则停下来请人决定。

像素风 AES 任务队列、执行与验证示意图

01 / PROBLEM

Agent 跑起来以后,怎样知道它做对了?

AES 是本地任务编排壳。它接收可验收目标,约束可访问路径和工具动作,把执行过程记录下来。这是个人工程实践,不是自研模型、Cursor 替代品或成熟 SaaS。

我的职责

定目标、定边界、做验收

我提出搭建目标,确定 IDE 优先、危险动作人工批准和模糊目标拒绝等边界;具体模块与 Agent 协作迭代,并检查 doctor、权限和评测记录。

关键取舍

先把人和 Agent 的责任分开

编码流程可以交给 Agent 协助;推送、建 PR、危险 shell 与删除路径等动作进入 HITL。拒绝后停止并写入 trace,不默默继续。

02 / WORKFLOW

一个目标进入系统后

CLI 的 go 默认在当前进程直接运行;队列路径则先入队,再由 worker 以 atomic claim 领取。IDE handoff、API loop 和 MCP stdio 提供其他入口。

01 / CHECK目标校验

目标模糊时拒绝;明确后才继续。

02 / ANALYZE分析

确认任务范围与允许修改的路径。

03 / CODE编码

调用受限工具执行修改。

04 / TEST + FIX测试与修复

失败则按策略重试或升级处理。

05 / EVIDENCE留存证据

输出 trace、artifact 和评测线索。

区别:go 直接运行和 queue / run --once / daemon 是两条路径。队列用于多任务与多窗口路径隔离,不是运行 go 的前提。

03 / HUMAN GATE

哪些动作必须停下来确认

需要人工批准

  • 推送代码、修改 remote、创建 PR
  • 危险 shell、删除路径、刷写固件
  • 失败升级后的高风险动作

可在安全范围内执行

  • 允许路径中的文件读写
  • 白名单内的 shell 命令
  • 本地 commit 与测试

04 / EVIDENCE

证据的范围,也写清楚

12 / 12同组 toy fixture,优化前后均通过
−15.5%历史记录中的估算 token 变化
HITL高风险动作需要人工批准
2026-09-18 历史记录:12 个 toy case 前后均为 12/12,不能据此声称真实大仓成功率提高。117,002 → 98,876 token 是该组记录的估算值。
NEXT QUESTTwin · 本地 Agent 工具集成→