Goal 为什么又停了:删掉 64 轮上限后,我重新理解了 Agent runtime
Orca Goal Mode 第二轮重构:固定 64 轮上限误判 NoProgress,到 runtime 收回生命周期,以及 admission 矩阵如何替代无语义计数器。
共 7 篇文章
Orca Goal Mode 第二轮重构:固定 64 轮上限误判 NoProgress,到 runtime 收回生命周期,以及 admission 矩阵如何替代无语义计数器。
复盘 Orca v0.2.46 Goal Mode 事故:session 取证、thread-local 失效、schema 与执行能力分叉,对照 Codex / Claude Code / Grok Build 重构 ownership,并用真实 DeepSeek 和 Linux CI 收口。
本文复盘 Orca v0.2.21 的一次真实生产事故:长任务已完成并提交,但 DeepSeek 最终没有产生可见 content 或 tool call,导致 Goal 被判失败。文章涵盖日志取证、语义恢复、会话历史保护、usage 统计、失败持久化、预算治理、回归测试和正式发布。
本文从 Orca 一次真实 DeepSeek V4 适配出发,解释 DeepSeek-native Coding Agent 为什么需要沿着 provider 行为、tool calling 语义和 agent runtime 一起调整。文章复盘 update_plan 布尔状态归一化、reasoning_content 工具回放、DeepSeek strict mode、update_goal、glob anyOf schema、max_tokens、空响应重试、工具数量上限、系统提示瘦身和 real API 探针。
这篇文章从生产系统视角解读 DeepSeek DSpark:半自回归草稿生成、置信度调度验证、线上吞吐和单用户速度提升,以及为什么它应该被理解成推理服务能力,而不是模型能力升级。
这篇文章复盘 Orca 针对 DeepSeek Prefix Cache 的九轮缓存优化:从 budget hint 破坏 system prefix,到 volatile 上下文、wire 等价 token 计算、summary state、extractive compaction、remote summary 0% 命中,再到最后用真实 API 评测把主链路稳定到 99% 左右。
Orca 是一个用 Rust 编写、围绕 DeepSeek 推理与工具调用语义打造的终端 Coding Agent。它实现了多轮 Agent 循环、SSE 流式、1M 上下文自动压缩、审批策略、子 Agent、工作流、持久化目标模式与会话历史。本文聊聊我为什么押注 DeepSeek 生态,以及 Orca 的设计与用法。