Pi Agent 101|00|Reading Guide
写给 Agent Harness 入门者和 OpenClaw 读者的 Pi Agent 101 导读:先用最基础的概念看懂 agent 底盘,再进入 runtime、工具、会话、上下文和产品化。
阅读全文关于 LLM 101 的文章、框架与实践记录。
115 篇文章
写给 Agent Harness 入门者和 OpenClaw 读者的 Pi Agent 101 导读:先用最基础的概念看懂 agent 底盘,再进入 runtime、工具、会话、上下文和产品化。
阅读全文
LoopLens 是一个本地调试工作台,用来把 Claude Code 和 Codex 一次运行里的模型请求、工具调用、hooks、网络流量、token 与 compact 边界串起来看。
阅读全文
一张面向产品经理的 Agent 产品设计总表:从产品承诺、任务入口、控制层、人类节点、权限、工作空间、长任务、信任、指标、评估、可观测性、可靠性、平台到自主等级,判断一个 Agent 是否真的可交付、可控制、可信任、可运营。
阅读全文
Autonomy Levels 不是给 Agent 贴等级标签,而是把每类任务的授权范围、停顿点、证据要求、回滚方式和升级条件写清楚。
阅读全文
Agent Platform 的核心不是堆更多 Agent,而是把创建、连接、运行、权限、评估、监控、发布、治理和生命周期变成可复用的平台能力。
阅读全文
Reliability 不是让 Agent 永不犯错,而是把失败影响控制在可接受范围内,并让产品能够检测偏离、保留进度、恢复状态、重新验证结果。
阅读全文
Observability 不是给工程师多一份日志,而是让用户、产品、运营和治理团队都能看见 Agent 的计划、行动、证据、失败原因与恢复路径。
阅读全文
Evaluation 在 Agent Product 中不是单次离线 benchmark,而是围绕真实任务、工具调用、人工审核、失败恢复和业务结果建立持续评估系统。
阅读全文
Agent Product 的指标不能只看模型命中率或消息数,而要衡量任务是否被正确接收、推进、恢复、交付并被用户接受。
阅读全文
Trust UX 不是把界面做得像安全产品,而是在关键时刻让用户看懂 Agent 的计划、证据、风险、权限、恢复路径和责任边界。
阅读全文
Long-Running Tasks 让 Agent 从一次聊天回复升级为可排队、可暂停、可恢复、可通知、可验收的后台工作对象。
阅读全文
Workspace 是 Agent 产品的任务容器:把目标、上下文、文件、状态、日志、预览、协作和交付物组织成一个可恢复的工作对象。
阅读全文新文章直接送到邮箱。没有信息流焦虑,只有值得保留的工程与产品方法。
免费订阅