Agent Observability · Demo 已跑通

Agent Task Audit 插件实战
让多 Agent 工作可复盘

当最强模型当总指挥、子 agent 分模块执行时,用 hooks + self-report 协议记录谁做了什么、用了哪些工具、哪些 token 是精确的、哪些只是估算。

下载资料

6

Demo 事件

3

Worker 自报

1,238

精确 Token

中英

Owner Report

学完你能做什么

  • 解释 Codex/Claude 多 agent 工作为什么需要审计
  • 区分自动 hook 记录、子 agent 自报和平台不可见边界
  • 使用 Agent Task Audit 记录工具调用、模块分工和 token 可见性
  • 把 raw logs 转成 owner 能看懂的中英文报告
  • 设计子 agent self-report 协议,让每个 worker 对自己的模块负责
  • 运行本地 demo viewer,导入 NDJSON 日志查看任务报告

课程资料下载

提交信息后下载

提交基本信息和兴趣话题后下载 PDF、讲稿和 demo 截图。

为了把资料发给真正感兴趣的人,下载前请留下基本信息和你关心的话题。提交后会自动打开资料。

课程结构

从黑箱问题,到插件架构,再到 demo 和产品化路线。

Now
Week 01

为什么需要审计

Goal、总指挥、子 agent 和 owner 不透明问题

Week 02

通用性边界

通用 schema vs Codex/Claude 平台差异

Week 03

插件架构

hooks、self-report、owner report、viewer

Week 04

自报协议

每个子 agent 必须交代 role/module/model/tools/tokens

Week 05

Demo 实操

导入 NDJSON,看 owner summary 和 cost visibility

Week 06

产品化路线

Claude hooks、跨机器安装、HTML/PDF report

核心方法

自动记录事实,自报协议记录责任

Agent Task Audit 不是隐藏调度破解器,它是多 agent 工作的记账本和交接单。

适合作为工具课和内部流程课
建议 45–60 分钟
PDF + Demo
报告 + Markdown + 截图

标准审计 Loop

  • 主 agent 接收 goal,并声明审计要求
  • hooks 自动记录 prompt、tool use、permission 和 stop
  • 子 agent 执行模块任务并写 self-report
  • report 区分 exact、estimated、unknown
  • owner 看摘要、分工、成本可见性和风险
  • 技术团队需要时再进入 raw timeline

3 层系统

Hook Events

自动事实记录

记录生命周期、工具调用、权限请求和可见 usage 字段。

Self Report

子 agent 责任交接

每个 worker 交代 role、module、tools、files、completed、blockers、tokens。

Owner Report

负责人可读

用中英文说明谁做了什么、钱花在哪、哪里仍然不透明。

Owner Report Checklist

每份报告至少回答:

1. 谁负责了哪些模块?
2. 哪些模型信息是可见的?
3. 哪些 token 是精确计数?
4. 哪些 token 是估算或自报?
5. 哪些工具、命令、文件被使用?
6. 是否有失败、blocker 或未知项?

建议讲授节奏

时间时长模块动作
00:00–10:0010 min多 agent 黑箱问题讲解
10:00–20:0010 min通用性和不可见边界澄清
20:00–35:0015 min插件架构和自报协议拆解
35:00–50:0015 minDemo viewer实操
50:00–60:0010 min产品化路线讨论

适合谁

适合把 Codex/Claude 用到真实交付、开发、研究和运营流程的人。

适合 ✓

  • AI 自动化顾问
  • 技术负责人和项目 owner
  • Codex / Claude 重度用户
  • 需要多 agent 分工复盘的团队

不适合 ✗

  • 希望绕过平台隐藏调度的人
  • 不愿意要求子 agent 自报的人
  • 只想看 raw JSON 不需要 owner 报告的人

常见问题

这个插件通用吗?

schema、自报协议和 owner report 是通用的;Codex 插件安装和 hook 路径是平台/机器相关的。Claude 需要用 Claude Code hooks 或 wrapper 接入同一套日志格式。

能看到所有真实 token 吗?

只能看到运行时暴露的 exact token。没有暴露的部分会标成 estimated 或 unknown,不会伪造成精确数据。

为什么需要子 agent 自报?

主 agent 不一定能看到所有内部细节。自报协议能把模块责任、产出、风险和估算成本收回来。

想让你的 AI 交付流程可审计?

我们可以帮你把 Codex/Claude 多 agent 工作流改造成可记录、可复盘、owner 能看懂的审计 loop。

下载资料