分类: agents
-
为什么 Agent Loop 也是插件?DeepSeek Harness 的插件系统
TLDR:在 DeepSeek Harness 里,Plugin 不是完整程序之外的可选附件,而是由 Cordis 装入同一 Node.js 进程、拥有明确依赖和生命周期的 TypeScript 模块。DSH 先用 Cordis 建立 Context;Cordis 再等待 Service、激活 Plugin,并在它离开时撤回它创建的 Effect。最常见的激活入口是 apply(ctx);Tool 只是 Plugin 可能注册的一项模型可见动作。Tool Registry、Session,甚至 Agent Loop 本身也都是 Plugin。
-
一句“修掉这个 Bug”之后:DeepSeek Harness 如何组织 Turn 与 Session?
TLDR:在 DeepSeek Harness 里,Follow-up Input 可以唤醒 Agent Loop。Turn 是一段连续运行,里面可以有多个 Step;每个 Step 对应一次模型请求,以及这次模型输出要求执行的 Tool。Session Event Log 记录的不只是聊天,还包括运行边界、模型可见内容和动作结果。Agent Loop 作为 Plugin 负责按顺序协调这些 Service,而 Persistence、Resume、Crash Recovery 与 Fork 都建立在同一份历史之上。
-
Agent Loop 只是起点:DeepSeek Harness 在模型之外做了什么?
TLDR:Agent Loop 解释了模型怎样在推理和工具调用之间循环。Harness 还要决定模型能看到什么、把工具请求变成实际操作、保存任务进度,并在危险动作触及系统之前把它拦下来。

-
Codex 源码阅读(VI):上下文工程
Codex 上下文是一个托管的运行时表面:AGENTS.md、skill、线程历史、压缩和运行时设置都有所有权规则,长任务才不会中途断掉。
-
Codex 源码阅读(V):安全模型
Codex 安全模型是一组分层执行边界:沙箱定义技术上能做什么,审批决定哪些操作要审查,执行策略给命令风险分类,操作系统后端负责强制执行。
-
Codex 源码阅读(IV):工具运行时
Codex 工具不是孤立函数,而是由策略绑定运行时支撑的模型可见接口。shell 命令、补丁、MCP、skill、权限、沙箱、流事件和历史记录都走同一条托管执行路径。
-
Self-Harness:会改进自己的 harness
Self-Harness 更适合理解为证据驱动的 harness 版本控制:挖掘失败轨迹,提出有边界的 harness 编辑,只提升能通过回归测试的改动。
-
Codex 源码阅读(I):agentic loop 是运行时边界
TLDR:Codex 的 turn 不是一次模型调用,而是一个托管执行窗口。用户输入、工具调用、工具结果、取消、压缩和最终答案都由运行时排序。