权限系统真正要证明的,不是“允许”,而是“在哪个边界内执行”
从一个可伪造的沙箱拒绝信息出发,解释 Agent 权限系统为什么不能把 stderr、项目配置或 UI 响应当成授权依据,并拆解 Capability Kernel、Execution Broker、workspace identity 和 fail-closed backend 这套设计选择。
共 11 篇文章
从一个可伪造的沙箱拒绝信息出发,解释 Agent 权限系统为什么不能把 stderr、项目配置或 UI 响应当成授权依据,并拆解 Capability Kernel、Execution Broker、workspace identity 和 fail-closed backend 这套设计选择。
一次基于 Orca 源码和测试的 TUI 卡顿排查,记录长对话误判、流式批处理、局部投影、commit 索引、token cache 和增量渲染的修复过程。
复盘 Orca runtime-owned typed surface 重构从普通 TUI turn 到 Goal、workflow、background、ACP 和 JSONL 的完整迁移,包括原子 batch、snapshot/cursor、interaction、terminal、restart recovery 与发布验证。
复盘 Orca runtime-owned typed surface 重构:从 TUI 与 runtime 的状态分叉,到原子持久化、snapshot/cursor、request-scoped interaction、terminal settlement、restart recovery 和真实 PTY 验证。
Orca Goal Mode 第二轮重构:固定 64 轮上限误判 NoProgress,到 runtime 收回生命周期,以及 admission 矩阵如何替代无语义计数器。
复盘 Orca v0.2.46 Goal Mode 事故:session 取证、thread-local 失效、schema 与执行能力分叉,对照 Codex / Claude Code / Grok Build 重构 ownership,并用真实 DeepSeek 和 Linux CI 收口。
本文复盘 Orca v0.2.21 的一次真实生产事故:长任务已完成并提交,但 DeepSeek 最终没有产生可见 content 或 tool call,导致 Goal 被判失败。文章涵盖日志取证、语义恢复、会话历史保护、usage 统计、失败持久化、预算治理、回归测试和正式发布。
Orca @ 文件搜索从同步 git ls-files / ignore 索引迁到 ignore + Nucleo 流式会话:对比 Claude Code 与 Codex、latest-wins、三层 stale guard、browse、warm catalog、线程所有权和百万路径门槛。
本文复盘 Orca 基于 Rust 和 ratatui 的 TUI 滚动性能重构,涵盖事件循环饥饿、Markdown 渲染缓存、消息 revision、视口虚拟化、超长会话滚动、PTY 探针和真实 DeepSeek API 验证。
本文从 Orca 一次真实 DeepSeek V4 适配出发,解释 DeepSeek-native Coding Agent 为什么需要沿着 provider 行为、tool calling 语义和 agent runtime 一起调整。文章复盘 update_plan 布尔状态归一化、reasoning_content 工具回放、DeepSeek strict mode、update_goal、glob anyOf schema、max_tokens、空响应重试、工具数量上限、系统提示瘦身和 real API 探针。
本文复盘 Orca 一次真实卡死反馈:从 session 日志定位长会话压力,到参考 Codex 和 Claude Code 的上下文处理方式,再到实现 ranged read_file、grep/glob 分页、去除旧 reasoning replay、soft compaction、tool output micro-compaction、TUI 状态提示和回归测试。