Pi Agent 101|00|Reading Guide
写给 Agent Harness 入门者和 OpenClaw 读者的 Pi Agent 101 导读:先用最基础的概念看懂 agent 底盘,再进入 runtime、工具、会话、上下文和产品化。
阅读全文
LoopLens:看见 Claude Code 和 Codex 如何运行
LoopLens 是一个本地调试工作台,用来把 Claude Code 和 Codex 一次运行里的模型请求、工具调用、hooks、网络流量、token 与 compact 边界串起来看。
阅读全文
Agent Product 101|15|Product Design Checklist:Agent 产品设计总表
一张面向产品经理的 Agent 产品设计总表:从产品承诺、任务入口、控制层、人类节点、权限、工作空间、长任务、信任、指标、评估、可观测性、可靠性、平台到自主等级,判断一个 Agent 是否真的可交付、可控制、可信任、可运营。
阅读全文
Agent Product 101|14|Autonomy Levels
Autonomy Levels 不是给 Agent 贴等级标签,而是把每类任务的授权范围、停顿点、证据要求、回滚方式和升级条件写清楚。
阅读全文
Agent Product 101|13|Platform:从单个 Agent 到系统能力
Agent Platform 的核心不是堆更多 Agent,而是把创建、连接、运行、权限、评估、监控、发布、治理和生命周期变成可复用的平台能力。
阅读全文
Agent Product 101|12|Reliability:让失败可恢复
Reliability 不是让 Agent 永不犯错,而是把失败影响控制在可接受范围内,并让产品能够检测偏离、保留进度、恢复状态、重新验证结果。
阅读全文
Agent Product 101|11|Observability:看见 Agent 如何工作
Observability 不是给工程师多一份日志,而是让用户、产品、运营和治理团队都能看见 Agent 的计划、行动、证据、失败原因与恢复路径。
阅读全文
Agent Product 101|10|Evaluation:评估真实产品表现
Evaluation 在 Agent Product 中不是单次离线 benchmark,而是围绕真实任务、工具调用、人工审核、失败恢复和业务结果建立持续评估系统。
阅读全文