两种世界的交互形态:协同 Agent 与自主 Agent
15 min从"意识涌现"到"场域建立",分析协同 Agent 与自主 Agent 两种形态的设计思路与开发方向。
编程 Agent 的工程实践:来自 OpenAI 与 Anthropic 的实战经验
19 min从 OpenAI Codex 和 Anthropic Claude 的工程实践中提炼构建长期可靠运行的 Agent Harness 的核心经验。
Anthropic 黑客马拉松冠军:ClaudeCode 配置整理和补充
18 min整理黑客马拉松冠军 Claude Code 配置合集中的核心模式:跨会话共享内存、持续学习、检查点评估、代码地图与子智能体编排。
给 Agent 接入 Browser use 的设计思路
11 min从 CUA、DOM CUA 到 Playwright,梳理 Agent 控制浏览器的核心实现思路与 Codex、Open-Browser-Use、ActSpace 三种架构设计对比。
ActSpace 评估模块的设计思路
8 min依靠感觉和经验可以让你走起来,但要走的更远,我们需要一个构建优化的"理由"——Agent 评估模块的设计实践。
让 Agent 从被动变为主动:定时任务和 KAIROS 模式
10 min从定时任务到 ClaudeCode 的 KAIROS 模式,探索让 Agent 从交互式变为常驻后台运行的设计思路:Sleep 工具与 tick 事件驱动。
Agent Bash 工具工程化:后台运行与沙盒权限设计
6 min从后台挂载、增量读取、事件推送到 macOS sandbox-exec 三层沙盒——Agent Bash 工具从 demo 到线上级的关键两环。
揭秘 AI 代理的评估:多种 Agent 的评估方法
16 min从编码 Agent、对话 Agent、研究 Agent 到计算机使用 Agent,梳理不同类型 Agent 的评估要点与 pass@k / pass^k 指标。
工具调度与权限模块的开发
8 min设计 Agent 的工具执行调度——7 种状态机、4 层权限模式、配置文件规则系统与 allowList 机制,参考 ClaudeCode / Gemini-cli / OpenCode / Kode。
多智能体的协作方式:Agent Team 和 Agent Room
15 min探索多智能体协作的两种核心模式——Agent Team(临时团队攻坚)和 Agent Room(平等讨论),以及任务调度与成员设计。
Bash 工具实现和安全权限设计细节
34 minAgent Bash 工具的完整实现——工具定义、Generator 模式执行、返回值设计,以及 24 条静态安全检查规则与三层权限验证体系。
Agent 文件系统检索核心:Grep 和 Glob 工具
9 minGlob 与 Grep 工具的降级策略——glob 包 vs ripgrep、四种 Grep 实现优先级、ripgrep 自动下载机制,以及基于 AbortController 的超时控制。
学习和整理 Pi 的 LLM 模块设计
13 min深入分析 Pi 编码 Agent 的 LLM 模块设计:多供应商适配、内部通用消息格式、EventStream 事件流与 Agent 执行链路。
智能体系统构建策略:单智能体和多智能体
23 min从架构设计、上下文管理、工具交互三个维度分析单智能体与多智能体的优劣势,提出渐进式构建策略。
上下文压缩调度:工具裁剪与历史记录压缩
4 min上下文压缩的前置策略——工具输出裁剪(限制最大内容、分层读取、LLM 摘要、渐进式读取)与兜底策略——会话历史记录压缩。
上下文压缩指令:ClaudeCode 与 Gemini 的压缩提示词解析
31 min深度解析 ClaudeCode 的 8 节压缩算法和 Gemini-cli 的 5 点 scratchpad 方式,以及工具消息裁剪与中间/最旧策略选择的完整实现。
Agent 的评估:评估方案和方法
17 min为什么 Agent 评估这么重要?评估的四大组成、完整流程和三种评分方法(代码评分、人工评分、模型评分)的实战详解。
为你的 Agent 集成 Skill 系统
20 min为自己开发的 Agent 添加 Skill 支持时的核心步骤:发现、解析、使用、管理,以及渐进式披露策略的实践指南。