跳到正文
7月21日周二
  1. AgentLab

    Oh My Pi 17.0.6: 扩展 Web Search 契约,修复 Subagent 隔离与 Context 恢复问题

    Web Search 加入工具清单,Tool Schema 改为要求 `i`、`query`、`recency`、`limit`、`max_tokens`、`temperature` 和 `num_search_results`,使调用方必须提供完整参数。官方发布说明还记录了 `ensureIsolation` 为隔离仓库拆分 `.git` 元数据、拒绝将自定义端点与官方 OAuth 凭据混用,以及修复 Context 溢出和计划 Session 恢复路径;这些改动分别影响 Subagent 分支隔离、Web Search 凭据边界与长对话恢复行为。Static Prompt 资产比较不可用;所给官方发布说明在截断处之后未纳入分析。

  2. AgentLab

    Claude Code 2.1.216: Sandbox 配置与长 Session、恢复和授权可靠性修复

    新增 `sandbox.filesystem.disabled` 配置,可关闭文件系统隔离而保留网络出口控制,改变了 Sandbox 的可配置边界;长 Session 消息规范化的二次方开销得到修复,降低多轮对话中的卡顿并改善恢复速度。发布说明还涉及恢复时还原后台 Agent 的 Prompt 和工具限制、阻止隔离 Subagent 借 Git 参数写入共享 checkout,以及通过链接路径逃逸写入等 Session、执行和文件安全问题。Runtime Prompt 的 Skill 工具说明有所改写,但工具增删统计为零;没有源码样本可用于定位这些发布说明所述实现。

  3. AgentLab

    Crush 0.86.0: 新增 LSP 重构工具,并为失败操作保留 Edit Tool 回退

    Crush 0.86.0 在工具层加入基于 LSP 的符号重命名与整段符号替换操作:`lsp_rename` 覆盖符号及其引用,`lsp_replace_symbol` 支持替换、前后插入或删除函数、方法和类。发布说明规定 LSP 操作失败时向模型报告错误,使其可回退到 `edit`;这让 Agent 能尝试语义化重构,同时保留既有编辑路径。发布说明还记录了可滚动侧栏、可移除附件和流式连接重置恢复等更新。

  4. AgentLab

    Hermes Agent v2026.7.20: Hermes v2026.7.20:委派可观测性与交付恢复增强

    `delegate_task` 的契约扩展为单任务返回子任务实时日志、批量任务返回统一句柄并在全部完成后汇总;官方说明还描述了持久交付账本,使进程重启后可恢复委派结果和已生成回复。审批流程增加针对每条 flagged command 的独立审查,并允许用户定义即使在 yolo mode 下也生效的拒绝规则,改变了命令授权行为。Runtime Prompt 同时提高了 `browser_snapshot` 的截断阈值并为完整快照提供文件路径;当前差异未提供这些官方功能的源码实现细节。

7月20日周一
  1. AgentLab

    opencode 1.18.4: Kimi 推理控制适配,桌面输入与评审交互修复

    Core 层为 Anthropic-compatible Provider 的 Kimi 模型采用 adaptive thinking controls,并默认输出摘要化 reasoning;同时修正 reasoning 选项回退和 Azure Cognitive Services endpoint 支持,影响模型推理参数与连接兼容性。Desktop 层改写 v2 prompt input 的交互处理,并修复 Session 视图、命令草稿、空文本发送、diff 汇总和窗口恢复等问题,提升输入与评审流程的可靠性。相邻 Runtime Prompt 仅有 Git 环境中的日期变化,未观察到 Tool Schema 变化;未提供 Static Prompt 与代码样本,无法据此定位实现文件。

  2. AgentLab

    Kimi Code 0.28.1: ACP 凭据接入、Web Server 前台化与 Subagent 权限模式同步

    ACP Session 现在可使用已配置的非 OAuth 模型凭据启动,免去必须先完成 Terminal 登录的限制。Web Server 生命周期改为前台运行:`/web` 每次启动新 Server,退出时用 Ctrl+C;同时修复运行中的 Subagent 未跟随启动后权限模式切换的问题。Runtime Prompt 与 Tool Schema 的相邻版本比较无变化;Static Prompt 比较不可用,官方发布说明未提供实现源码样本。

  3. AgentLab

    MiMo Code 0.1.7: 0.1.7:加入首轮 Skill 检索与匹配流程

    Skill 工具链新增 `skill_search`,并在 Runtime Prompt 中规定:首轮任务适合专门工作流时,先把请求整理为包含动作、输入、输出、受众的 Skill Query,按精确名称或别名及 BM25 匹配 Skill,再依据命中、候选或无匹配结果决定加载或继续。工具列表增加 `skill_search`、既有 `skill` Definition 有修改;这让 Skill 发现从单靠任务描述触发加载,扩展为可显式搜索与分流的流程。官方发布说明为空,证据未提供对应实现代码样本。

  4. AgentLab

    Kimi Code 0.28.0: Web 服务改用前台实例管理,权限模式说明与实际行为对齐

    服务管理从 `kimi server` 命令树转为 `kimi web`:服务在前台运行,后台守护进程和 OS 服务生命周期命令移除;`kimi web ps`、`kill`、`rotate-token` 管理实例,多个实例可共用 home 并依次选择空闲端口。这使部署与进程管理契约发生变化,旧命令会显示弃用提示并以状态码 1 退出。Thinking effort 只持久化低于模型最高档(max)的级别;YOLO 与 Auto 的说明被修正为分别表示自动批准 Tool 操作但仍可提问、以及完全自主且不提问。Runtime Prompt 与 Tool Schema 相邻版本相同;Static Prompt 比较不可用,官方发布说明是本次变化的依据。

  5. AgentLab

    Reasonix 1.17.16: Reasonix 1.17.16:并行 Subagent 舰队、远程 SSH 与 MCP 授权调整

    Reasonix 加入可配置并发度的 Subagent 舰队,支持最多 64 个并行任务、配置文件 System Prompt、后台运行和写入路径协调;同时增加通过 SSH 在远程主机运行 Agent 与工具的能力。MCP 安装与授权从旧信任状态机转为按项目授予启动权限,并调整工具批准流程;Session 导出、恢复和保存也增加了分割、保留中断输出及锁等待超时等行为。发布说明列出了相关 PR,但本 packet 没有提供源码变更概览,因此代码落点无法从当前证据确认。

7月19日周日
  1. AgentLab

    Raven 0.1.6: 加入自演化与 AppWorld 入口,并改善启动响应

    0.1.6 加入自演化运行栈,覆盖 evolver runtime、AppWorld 基准适配、受保护的激活、评估、调度、树存储和启动编排入口,为 Agent 自我改进与基准评测提供新路径。CLI 延迟导入 LiteLLM,TUI 将 Provider 与 Memory 加载推迟到首屏之后,减少轻量命令的冷启动成本并改善首次渲染响应。发布说明还提到版本号改从已安装包元数据读取、追踪面板只复用 Raven 自有端口;本包未提供代码变更概览,无法定位这些机制的具体实现位置。

  2. AgentLab

    Cline 3.0.45: 按需加载 Provider,并收紧 Team runs 的 Subagent 入口

    Claude Code 与 Codex Provider 改为可选并按需加载,官方说明称全局安装体积从约 640MB 降至约 285MB;Team runs 不再向队友暴露 spawn 工具,错误的队友运行也会报告为失败。运行重试会先刷新过期 OAuth 凭据再重试一次,Hub 状态输出增加版本号。发布说明未提供对应代码路径;Runtime Prompt 与 Tool Schema 的相邻比较显示无变化,Static Prompt 比较不可用。

  3. AgentLab

    Oh My Pi 17.0.5: omp 17.0.5:异步任务交付语义明确化,浏览器与 Session 生命周期边界收紧

    `hub jobs`/`hub wait` 观察到已结束任务时,该状态快照即视为结果交付,抑制重复的 `async-result`;任务记录约五分钟后过期,`completed` 只代表任务成功退出,Agent 仍需核验产物。Browser Tool 的契约补充了 ElementHandle 与字符串选择器的区别、重渲染后的引用失效规则及请求拦截的 run 级清理;官方发布说明还记录了消息 Token 估算缓存、按调用决定 Tool 可中断性,以及凭据缓存脱敏等代码层变化。Runtime Prompt 的变化集中在 `hub`/`task` 和浏览器操作说明,Tool Schema 仅见 `hub`、`task` 修改;Static Prompt 当前不可用,因此下文不会据此推断其变化。

7月18日周六
  1. AgentLab

    Codex 0.144.6: 强化破坏性操作防护,并更新 GPT-5.6 指令与 Context 配置

    Runtime Prompt 在“Destructive Actions”中加入破坏性操作前的目标确认、范围限制、可恢复操作优先和删除后告知等规则,并要求环境变量使用专用名称;这使 Agent 执行删除或覆盖操作时有了更明确的操作边界。官方发布说明确认本版刷新了 GPT-5.6 Sol、Terra、Luna 的 bundled instructions,并将其 context window 修正为 272,000 tokens。

  2. AgentLab

    Oh My Pi 17.0.4: 17.0.4:收紧 task 输出契约并修复 Session 与实时 Transcript 路径

    task 的 Tool Schema 将 outputSchema 从宽泛布尔标记改为明确接受 object、string、boolean 或 null 的联合约束;官方说明称此调整避免 Moonshot/Kimi 请求与 llama.cpp grammar 生成因布尔子 Schema 失败。Session 加载仅在条目包含 blob 引用时才递归解析,Transcript 则压缩已提交的 assistant 历史块,使长历史下实时渲染不再随 Session 深度持续增长。其余发布内容集中在 Kimi 用量与设备标识、退出时 Memory 整理、Linux 录音及本地 embedding 缓存的局部可靠性修复。

  3. AgentLab

    Antigravity CLI 1.1.4: 1.1.4:Slash Command 链式解析与 headless 策略一致性

    CLI 现在可按输入顺序解析、激活并渲染多个前置 Slash Command;headless(`-p` / `--print`)执行也会遵循持久化设置中的权限、文件访问、Sandbox、自动执行和 Artifact Review 策略。官方说明还记录了 `subagent: false` 的 Agent 不再出现在可用 Subagent 列表或被作为 Subagent 调用,以及 /diff 滚动、`/btw` 对话列表、Enter 键绑定和 eligibility 错误提示的修复。

  4. AgentLab

    Reasonix 1.17.15: Reasonix 1.17.15:恢复 MCP 持久 Session 并加固 Thread 切换

    官方发布说明描述了 MCP stdio 服务器跨调用复用进程、兼容信任状态迁移,以及服务器身份变化时重新验证;同时调整长任务重试与 Desktop Session 快照和激活行为,减少卡住、切换卡顿和内容被旧激活覆盖。CLI 输入区与状态栏也改为适应长草稿和窄 Terminal。当前 Runtime Prompt 与 Tool Schema 捕获状态不可用,且没有相邻比较基线;Static Prompt 也不可用,因此这些变化来自官方发布说明,无法与源码实现细节交叉核对。

  5. AgentLab

    Claude Code 2.1.214: 2.1.214:新增受限的 Session 结束控制,并收紧多类命令授权

    新增 EndConversation 工具,为主 Thread 提供显式的结束路径;其 System Prompt 契约限定了适用情形、警告与确认步骤、危机内容豁免和后台 fork 行为,影响 Session Lifecycle 与分支任务的处理方式。与此同时,官方发布说明记录了多项命令权限检查修复与授权范围调整,涵盖 Bash、PowerShell、Docker 远程选项和文件读取命令,减少误自动批准的情形。捕获差异只直接显示新增工具及其 System Prompt 规则;权限修复细节来自官方说明,源码实现位置未提供。

  6. AgentLab

    Oh My Pi 17.0.3: 17.0.3:结构化 Subagent 执行统一,Session 与工具链边界更清晰

    编排机制扩展为可选择 Agent、覆盖输出 Schema、指定严格校验模式及隔离工作树的结构化 Subagent 调用,并明确前台结果与后台 handle 的交付形式;Runtime Prompt 的 `agent` 与批量任务输入契约同步体现这些选项,帮助 Agent 以可控结构委派并消费结果。Session 与工具路径也收紧:`history://` 只覆盖进程内已注册 Agent 和可从 artifact tree 发现的持久化 Subagent,`/new` 的队列边界、MCP 重新认证和 detached server 关闭流程得到修复。官方发布说明另列出模型传输、读写、Context 展示、账户归属及 TUI 等局部修复;Static Prompt 未提供,源码样本未提供,以下实现位置依据 Runtime Prompt 与官方发布说明陈述。

7月17日周五
  1. AgentLab

    Kimi Code 0.27.0: Kimi Code 0.27.0:加固 URL Fetch 与存储恢复,补充调试和复制入口

    内置 URL Fetch Tool 收紧对 loopback 和内网服务的访问,处理构造域名与重定向链带来的越界路径;发布说明还指出嵌入式 KV 引擎改进 WAL 压缩、并发写入和跨进程读取,使存储在写入压力、进程竞争和恢复场景下更可靠。CLI 增加受 `--debug-endpoints` 控制的本地调试 RPC,`/copy` 可复制最后一条 Assistant 消息,重复导出则使用带时间戳的文件名以避免覆盖。Runtime Prompt 与 Tool Schema 的相邻比较显示无变化;本 packet 未提供源码变更样本,以上实现细节来自官方发布说明。

  2. AgentLab

    Oh My Pi 17.0.2: 17.0.2:移除图像生成 Tool Definition,收紧多 Agent 故障隔离与运行时资源管理

    Runtime Prompt 的 `xd://generate_image` Tool Definition 被移除;代码层同时调整了顾问(advisor)失败时的等待与重试边界、Context 维护,以及扩展定时器和子进程 stderr 的生命周期管理。官方发布说明还记录了 MCP 工具透传、Plugin 隔离、Checkpoint 状态追踪和 Terminal 清理等修复,影响从 Tool 可见性延伸到 Session 可靠性。Static Prompt 对比不可用;Runtime Prompt 中其余删改涉及环境信息,不能据此推断功能变化。

  3. AgentLab

    Cline 3.0.44: 改进跨 Provider 的输出 Token 处理与 BOM 配置解析

    SDK v0.0.64 调整了 Gateway 路由、OpenAI Vendor 和推理模型的最大输出 Token 处理,目标是让这些 Provider 路径更妥善地处理输出上限。它也修复了以 UTF-8 BOM 开头的 Frontmatter 和配置文件解析,使 Windows 编辑器保存的此类文件能够正常读取。Runtime Prompt 与 Tool Schema 相邻版本一致;Static Prompt 比较不可用,且没有代码变更样本可定位实现细节。

  4. AgentLab

    Pi 0.80.10: pi 0.80.10:修正 Kimi Coding 自适应思考与模型元数据

    Kimi Coding 的请求适配调整为使用 Anthropic 自适应思考机制且不传 token budget,并允许回放空签名的思考块;K3 的思考等级元数据仅公开受支持的 `max`。这让 Agent 能按模型支持的思考契约发送请求并处理回放,同时修正 K3 定价元数据和模型目录生成恢复逻辑。Runtime Prompt 与 Tool Definition 的相邻版本比较显示无变化;Static Prompt 比较不可用。

  5. AgentLab

    Grok Build 0.2.102: Grok Build 0.2.102:收敛操作安全与工具指引

    System Prompt 将操作安全规则压缩为按可逆性和影响范围判断,并保留对高风险操作先确认、一次授权不扩展到其他情境的要求;工具说明也明确写出文件覆盖前先读取。与此同时,Plan Mode 的进入条件扩展到用户要求写计划,退出时改为向用户呈现计划而不再写明等待批准;Subagent 的可选模型说明限定为用户明确要求时才指定,并列出 grok-build。整体上,这些变化调整了 Agent 的确认、规划和 Subagent 配置指引,但没有证据显示 Tool 的权限或生命周期发生变化。Runtime Prompt 与 Tool Schema 有相邻版本差异;Static Prompt 和官方代码变化未提供可比较证据。

  6. AgentLab

    Claude Code 2.1.212: 为 Review 报告增加短摘要,并限制搜索与 Subagent 循环

    ReportFindings 的 Tool Schema 新增最多 60 字符的 `short_summary`,为紧凑界面提供只表达结论的标签。发布说明还记录了 Session 级 WebSearch 与 Subagent 调用上限、`/fork` 创建独立后台 Session,以及 Plan Mode 文件修改命令的权限修复;这些变化分别影响报告呈现、循环控制、Thread 编排和执行授权。

  7. AgentLab

    Pi 0.80.9: Pi 0.80.9:Kimi K3 接入与扩展工具延迟加载

    本版通过扩展驱动的延迟工具加载机制,支持按需激活工具,并将 Kimi K3 支持扩展到多个内置 Provider;发布说明指向 Dynamic Tool Loading 文档与 `kimi-deferred-tools.ts` 示例。模型目录调整将 xAI 默认模型改为 Grok 4.5,并移除若干旧型号;Session 层也修复了首次 Assistant 响应前克隆或分叉时的提示。Runtime Prompt 与 Tool Schema 相邻版本一致;当前捕获没有 Static Prompt,未提供代码样本,因此这些机制细节只能按发布说明描述。

7月16日周四
  1. AgentLab

    Raven 0.1.5: 新增可选深度研究能力与解耦追踪子系统

    Raven 0.1.5 发布了可选的深度研究工具,支持 Agent 执行多来源、事实核查式研究,并通过渠道异步交付带引用的报告;可用 `raven deep-research enable` 单独启用。版本还加入与具体后端解耦的进程内追踪子系统,让运行时组件能够发出追踪数据。证据仅包含发布说明,未提供对应源码位置或 Runtime Prompt、Tool Schema 的相邻比较。

  2. AgentLab

    Pi 0.80.8: ModelRuntime 统一模型配置、认证与动态目录

    pi 将模型配置、Provider 认证和动态目录刷新集中到异步 `ModelRuntime`,SDK 通过 `modelRuntime` 接入,并由它解析请求认证与模型 headers;这改变了宿主集成的配置和请求组装契约。`ModelRegistry` 仍保留同步扩展读取接口,但其 `refresh()` 改为异步,扩展加载 `models.json` 后必须等待刷新完成再读取。发布说明还描述了 `/model` 后台刷新、Provider 自主管理的登录发现,以及 xAI 设备码 OAuth 和 Grok 4.5 Responses 支持;本包没有源码变更样本可供独立核验这些实现位置。

  3. AgentLab

    Reasonix 1.17.14: Reasonix 1.17.14:改善桌面诊断与 Windows Plugin Hook 兼容性

    本版调整了桌面端 MCP 连接错误摘要和 Windows Plugin Hook 的处理:错误摘要显示 npm 注册表主机与端点;Hook 可展开 `${REASONIX_PLUGIN_ROOT}` 等别名、运行 bash Hook,并处理非 UTF-8 输出。发布说明还记录了版本化中英双语更新日志、更新横幅链接与 Windows 可执行程序图标等桌面体验变化。发布说明确认了这些行为,但没有提供对应源码位置;Runtime Prompt 与 Tool Schema 的当前捕获及相邻比较均不可用,Static Prompt 比较也不可用。

  4. AgentLab

    Kimi Code 0.26.0: coder Subagent 获得更完整的编排工具

    Tools 中 Agent 的 coder 工具清单扩展至 Agent、AgentSwarm、后台任务、待办列表、Plan Mode 和 Skill;发布说明称 coder Subagent 的后台任务会在报告完成前收束。这让委派任务可以使用更多主 Agent 能力,并让完成报告等待后台工作结束。发布说明还记录了显式关闭 thinking、Session 迁移和 Context 用量显示等修正;本包没有代码变更样本,无法进一步定位其实现路径。

  5. AgentLab

    Oh My Pi 17.0.1: 完善 Subagent 输出寻址与多条执行、Provider 故障处理路径

    `agent://Parent/Child` 现在优先按层级解析嵌套 Subagent 输出,找不到匹配子项时才回退到 JSON 字段提取,减少规划 Agent 读取 Scout 等 Subagent 结果时的歧义。官方发布说明还记录了 blocker 在主回答结束后重新推动当前轮次、统一异步 Session 清理,以及 OAuth 刷新、Provider 回退和工具流式响应等修复,改善编排与执行可靠性。Runtime Prompt 对比只显示这条 URL 规则及 workstation 元数据变化;官方发布说明中的其他修复没有对应的源码样例可供定位。

  6. AgentLab

    Kimi Code 0.25.0: Kimi Code 0.25.0:收紧 Web API 与 Workspace 文件边界,扩展附件和 Provider 兼容

    Web Server 的 bearer-token 校验现在覆盖百分号编码的 API 路径,Session 文件 API 也阻止通过指向 Workspace 外部的符号链接访问主机文件;这直接收紧了 API 身份验证和文件访问边界。Web 聊天可附加任意文件类型:模型不能直接消费的文件会上传并以文件路径提供,供其按需读取;Anthropic-compatible Provider 的 effort 处理及 Session 恢复则补充了兼容模型配置和 thinking history 的规则。Runtime Prompt 与 Tool Schema 的相邻比较没有变化;Static Prompt 比较不可用。所给证据只有官方发布说明,没有代码变更样本或文件路径,因此实现位置无法从本包确认。

  7. AgentLab

    Reasonix 1.17.13: Reasonix 1.17.13:收紧 MCP 信任与恢复边界

    MCP 执行与审批链路集中加固:发布记录提到可信执行边界、官方 allowlist 与 receipt 完整性校验,以及在 MCP dispatch 处防篡改的只读授权;这使读写权限和执行身份更明确地受运行时校验约束。恢复、交付和 Windows 隔离也有修复记录,涉及回滚补偿、就绪状态恢复、并发写入隔离,以及退役 Windows 原生 Sandbox。证据包未提供源码变更样例或 Static Prompt 比较,以上机制依据官方发布记录中的提交标题归纳。

  8. AgentLab

    Antigravity CLI 1.1.3: 1.1.3:强化权限拒绝、MCP 超时与对话恢复可靠性

    本版在工具授权、MCP 调用和对话历史处理上补强运行时边界:headless 模式遇到需要确认的工具时软拒绝并提示允许规则;always-proceed 模式不再自动批准 Workspace 外写入;MCP 连接、工具列表和单次调用增加超时。对话历史损坏、长对话索引膨胀及启动时同步发现 Skill 等问题也得到修复,分别影响后续响应、渲染成本和交互启动延迟。Runtime Prompt 与 Tool Schema 的相邻比较显示无变化;以下实现位置与行为细节来自官方发布说明,未提供源码概览或文件路径。