跳到正文
8月19日周三
  1. AgentLab

    Kimi Code 0.37.2: Kimi Code 0.37.2:Subagent 面板与多标签侧栏设置

    Web 界面的 Subagent 详情面板调整了工作过程的展开状态和回合结束时间页脚;Settings 新增 Lab 标签,其中多标签侧栏开关默认关闭,启用后侧栏显示 Open、Done、Workspaces。代码变更样本涉及 Web 设计系统构建产物与 CHANGELOG,显示变化落在界面资源层,影响 Subagent 过程查看和侧栏导航选择。

8月18日周二
  1. AgentLab

    Apache Maka 0.1.11: 新增定时任务工具模块,完善 Terminal 交接重试

    0.1.11 新增 packages/runtime/src/scheduled-task-tools.ts,引入 ScheduledTask 类型、Zod 及任务字段和时间间隔上限常量,为定时任务工具提供实现入口。桌面端 app-shell-session-events.ts 增加 Terminal 交接的尝试次数与重试延迟常量,显示交接处理引入有限重试设计;多处导入同时转向按职责划分的包子路径。官方标签确认版本发布,但发布说明为空;Runtime Prompt、Tool Schema 和 Static Prompt 的相邻比较均不可用,零差异统计不能证明这些层保持一致,源码样本也未展示定时任务的完整注册与执行流程。

  2. AgentLab

    Reasonix 1.28.0: 恢复交付质量门槛,并限制后台写入租约

    Reasonix 1.28.0 恢复标准与交付角色的 Session 质量底线,并为交付 Session 加入写入后的完整性验证和最终就绪检查;同时规定最终 Agent 运行结束后 30 秒释放 Workspace 写入租约,即使后台任务仍在继续。这些机制分别约束交付完成判定与后台写入资源的占用时长,官方发布说明还记录了 DeepSeek-V4-Pro 的 System Prompt 人设与推理语言设置、阶跃星辰端点处理及桌面 Session 导航修复。

  3. AgentLab

    Kimi Code 0.37.0: Kimi Code 0.37.0:多 Skill 输入与 Session 管理增强

    官方发布说明描述了单条 Prompt 激活多个 Skill,以及 Web 端按 Workspace、状态和更新时间筛选并批量归档或恢复 Session,扩展了任务输入和跨 Workspace 管理机制。代码概览未提供实现样例或关键文件,因此这些实现位置与内部状态流转无法从源码直接确认。Runtime Prompt 的行为指引删去默认使用工具执行任务的要求,Agent Tool Definition 增加 TowerInit;这两项是 Prompt 与工具契约的独立变化。

  4. AgentLab

    Oh My Pi 17.3.7: 为受限 Sandbox 提供文件写入回退,并调整 xAI 与 Codex 模型配置

    ExtensionAPI 新增文件写入和删除回退注册机制:原生 write、edit、apply_patch 或 unlink 遇到权限错误时,可将操作交给宿主提供的特权通道;回退请求按真实目标路径解析,并携带发起操作的 Session ID,便于宿主实施路径与 Session 级策略。模型目录将指定 xAI 与 SuperGrok 默认模型切换为 grok-4.6,并将 Codex transport 上 GPT-5.6 系列的 Context 窗口下限调整为 1M;此外,xAI 请求默认携带版本 User-Agent,stats dashboard 支持显式绑定地址且默认仍限于 loopback。Runtime Prompt 与 Tool Schema 的相邻差异仅显示日期变更;Static Prompt 比较不可用。

  5. AgentLab

    Hermes Agent v2026.8.18: Hermes Agent v0.20.4:Bot 群聊、定时媒体发送与 SessionDB 稳定性更新

    这次补丁版把改动集中在 Hermes Bots 的群聊路由和长回合处理、cron 媒体发送,以及 SessionDB 的事件循环 Thread 与竞争问题;实现线索分别落在 `apps/desktop/src/plugins/hermes-bots/plugin.js`、`gateway/run.py` 等文件。发布说明称,群聊成员可处理长回合并改善 Markdown 渲染和跨机器路由,cron 增加可配置超时、手动运行附件与漏触发提示,SessionDB 修复 Thread 和竞争问题,因而这些路径的 Session 处理与调度反馈更完整。代码差异只检查了部分内容,以下实现细节以已观察到的文件路径和发布说明为限。

  6. AgentLab

    Antigravity CLI 1.1.14: Agent 定制继承统一,Workspace 外访问收紧为只读

    markdown-defined Agent 的定制继承改由 `inheritCustomizations` 一个开关统一决定,覆盖 Skill、规则、Plugin、Subagent 和 MCP Server,减少各类定制各自采用默认值而产生的不一致;Workspace 外访问则收窄为只读,写操作按 cycle mode 自动批准。源码概览只观察到 `CHANGELOG.md`,这些机制细节来自官方发布说明;Runtime Prompt 的相邻差异主要是 Artifact 编写规范删减,工具集合未变。

  7. AgentLab

    Raven 0.1.12: Raven 0.1.12:为 Skill 安装与主机执行增加安全门,并修正提醒路由

    Skill 安装现在经过安全策略门,主机执行模式会提示注入命令拥有完整主机权限并要求默认拒绝的明确确认;这改变了安装与高权限执行的授权边界。Cron 提醒按创建时绑定的 channel 由对应 runner 认领和投递,未互动的重复提醒达到单任务上限后会自动停用。CLI 交互入口转为 `raven tui`,旧 `cli` Cron channel 在加载时迁移到 `tui`;Session 首次消息自动生成标题,创建后立即持久化。以下机制来自官方发布说明,未提供对应代码样例;Runtime Prompt、Tool Schema 与 Static Prompt 比较均不可用。

  8. AgentLab

    Reasonix 1.27.0: Reasonix 1.27.0:强化 Todo 批量推进、锚点校验与桌面恢复

    Reasonix 将 Todo 推进扩展为单个工具回合内按序批量签收,并为 delete_range 增加文本观察与闭区间 SHA-256 锚点校验;相关代码落在 internal/agent/stale_anchor_guard_test.go、internal/agent/text_observation.go。发布说明称这些机制保留顺序推进、拒绝语义和幂等性,降低批量编辑使用过期或错误目标的风险。桌面侧新增 macOS FSEvents Workspace 监听和 Linux 渲染器恢复代码;Session 导航、工具结果缓存、Responses 工具回合及 Todo 回合结束行为也有改动。Runtime Prompt 与 Tool Schema 的相邻比较不可用;源码位置和具体机制以发布说明及代码概览所列为限。

  9. AgentLab

    Prime Agent 0.7.3: Prime Agent 0.7.3:强化任务续跑、Subagent 拓扑与清理所有权

    本版调整了 RLM Subagent 家族的发现机制,改由 daemon 持有的追加式 spawn ledger 记录拓扑和子任务展示信息;删除子任务时保留可读 transcript tombstone,同时清理其 kernel snapshot。工具循环也会在阈值压缩失败或跳过后恢复未完成工作,并在成功的中途压缩后继续推进 active goal;带认证的 host request 则加入请求 ID、generation fencing、取消信号和 currentness 检查。发布说明还记录了 Session 恢复、编辑 diff 展示及 Terminal 交互等行为调整,但未提供对应源码样例或文件路径。

  10. AgentLab

    Hermes Agent v2026.8.16.2: Hermes v2026.8.16.2:周期任务支持跨次连续性

    cronjob 的 Tool Definition 增加 `continuity` 开关,使周期任务能在下一次运行时读取自身最近一次输出,帮助去重并从前次结果继续;相关实现落在 `cron/scheduler.py` 与 `cron/jobs.py`。`process.session_id` 的 Tool Definition 同时明确支持唯一 ID 前缀,降低后台进程 Session 引用的输入要求。官方发布说明还列出 MCP 2.x、Bot Mode Plugin、执行环境隔离和 Session 交接等改动,代码概览也显示了相应模块;但代码差异仅检查了前缀范围,不能据此补全未观察到的实现细节。

  11. AgentLab

    Claude Code 2.1.234: Artifact 资产操作扩展,权限与 Remote Thread 行为修正

    Artifact Tool Schema 新增资产上传、分页列举、读取和永久删除操作,并规定通过 `_blob/{id}` 在页面引用资产;这让 Agent 能管理已发布 Artifact 的媒体文件,同时明确资产删除与资产能力的约束。官方发布说明还涉及 NT 命名空间路径拒绝、权限预览信任门控,以及 Remote Control 的权限模式和 effort 同步;这些机制分别落在文件访问、权限传递和 Session 状态同步行为上。

8月17日周一
  1. AgentLab

    DeepSeek Harness 0.1.0-rc.7: Plugin 设置、Subagent 任务与图片附件接入更多工作流

    本版把 Plugin 自定义设置卡片、Codex 与 Claude Code 的 Subagent 任务管理,以及持久化图片附件和 PTC Mode 的嵌套图片转发接入对应交互流程,扩展了设置面板、Job Panel 与 MCP/ACP 等功能面。发布说明还记录了 max-tokens 截断后的 Session 恢复修复和大历史分页栈溢出修复,改善长对话继续执行与历史浏览的可靠性。证据仅包含发布说明,未提供这些功能对应的源码位置;Runtime Prompt 与 Tool Schema 相邻版本一致,Static Prompt 比较不可用。

  2. AgentLab

    Reasonix 1.26.0: 统一 DeepSeek V4 计费报价并开放 Pro low Reasoning Effort

    版本将 DeepSeek V4 Flash/Pro 的峰谷价格纳入默认官方端点报价,并让预算、事件、统计及多端界面复用单次发生时的成本报价,价格显示因此保持一致。另在 OpenAI Chat、Responses 和 Anthropic 协议中支持为 DeepSeek V4 Pro 选择 low Reasoning Effort。证据来自官方发布说明,未提供实现文件或代码样例。

  3. AgentLab

    Qwen Code 0.21.13: ACP、评审与外部 Context 接入成为主要演进面

    本版本可观察到的代码变化集中在 ACP bridge 与 Agent Session、review command,以及 external-context provider contract;相关实现和测试文件均有改动或新增。配套设计文档覆盖 assistant response 的 Session branching、外部 Context provider 扩展和评审平台 provider 抽象,表明这些是本次主要的架构演进面,可能影响 ACP Session 接入、评审流程与外部 Context 接入方式。官方发布说明为空;代码差异仅检查了部分内容,以下结论限于已列出的文件路径和统计信息。

  4. AgentLab

    Reasonix 1.25.4: Reasonix 1.25.4:重整 Context 压缩与恢复,并扩展项目组织

    Context 压缩、推理历史恢复和普通回合收尾的实现分别落在 `internal/agent/compact.go`、`reasoning_warn_state.go` 与 `internal/control`;发布说明称压缩采用 80% 默认阈值、保留固定 16% 最近尾部,并最多执行两次成功的压力摘要,同时普通回合可在安全的验证或审查义务尚未完成时继续。桌面端新增项目树组织模块,将主题顺序和 Session 分组持久化到 `projects.json`;Terminal 剪贴板和长 Session 滚动也有对应改动,体现出更完整的 Session 与桌面交互管理。Runtime Prompt 与 Tool Schema 捕获及相邻比较均不可用,Static Prompt 比较也不可用;这些证据不能用来判断相关层是否变化。

  5. AgentLab

    Hermes Agent v2026.8.16: Hermes v2026.8.16:并发隔离、渐进式 Thread 检索与更安全的执行反馈

    浏览器 Session 现在按名称隔离 harness daemon(云端还隔离浏览器),Subagent 批处理上限由 3 提至 10;session_search 默认只完整展开排名第一的结果,其余先返回锚点消息,并可用 detail="full" 展开全部结果。对应变化落在 browser_exec、delegate_task、session_search 的 Tool Definition;它让并行工作更易扩展、Thread 检索更节省 Context,同时 Terminal Prompt 新增避免管道掩盖构建失败的执行规则。源码概览还显示本次发布涉及 Context 压缩、对话循环、工具执行、模型路由及桌面连接管理等实现;代码差异只检查了前缀,以下实现范围以已观察路径为限。

8月16日周日
  1. AgentLab

    Oh My Pi 17.3.5: 17.3.5:补强瞬时故障重试与 Session 恢复,调整 xAI Responses 接入

    pi-ai 新增 one-shot 瞬时故障重试,并由 compaction 等调用方选择启用、遵从服务端 retry-after;Session 维护与恢复代码也处理损坏的 JSONL 追加和部分连接错误,减少后台请求失败和恢复中断。模型目录及请求适配将付费 xAI 路由改为 Responses API,并处理加密 reasoning 的后续回放;浏览器工具的 close 契约明确为释放受管句柄,同时保护外部连接页面。官方说明列出更多扩展、编排、兼容性与界面修复;代码差异仅观察到截断前缀,Static Prompt 无可用比较。

  2. AgentLab

    Reasonix 1.25.3: Reasonix 1.25.3:统一执行策略,并加强授权与恢复机制

    Reasonix 以逐轮推导的自适应策略取代轻量、均衡与交付模式,将策略用于规划、验证和证据闭环;文件工具与 Bash 增加 Workspace 外写入的按需授权,支持一次、Session、项目或拒绝等决策。Context 溢出可在节省令牌的 Checkpoint 后继续,Thread 恢复则结合写者隔离与分叉优先回溯,以改善长工具轮次和重启后的连续性。以上机制来自官方发布说明及其列出的变更;本包未提供对应源码概览,Runtime Prompt 与 Tool Schema 的相邻比较状态为 unavailable。

  3. AgentLab

    Grok Build 1.0.5: Grok 1.0.5:增强 Worktree 清理与 Git 安全检查

    代码差异显示,版本重点落在 Worktree 垃圾回收和 Git 安全检查:新增 `api/gc`、`process_scan`、`git/safety` 与 `git/probe`,并调整 `auto_gc.rs`、`api.rs`。这些路径表明清理流程加入了进程扫描和 Git 可达性、安全判断机制,可能影响何时及如何回收 Worktree;`consent.rs`、Subagent 尝试存储编解码和 Memory 后端也有改动,显示版本同时涉及授权界面与状态存储。代码差异仅观察到截断前缀;Runtime Prompt/Tool Schema 比较为零变化,Static Prompt 比较不可用,npm 发布说明为空。

8月15日周六
  1. AgentLab

    Claude Code 2.1.233: 收窄新模型的任务跟踪工具,并扩展 Artifact 回复控制

    Runtime Prompt 移除了 TaskCreate、TaskGet、TaskList、TaskUpdate 四个 Tool Definition,Artifact Tool Schema 则新增 `acknowledge_duplicate`,让回复者可显式发布有新内容的后续回复。官方发布说明将 todo/task-tracking 工具的不可用范围限定为列出的新模型,并提供 `CLAUDE_CODE_ENABLE_TODO_TOOLS=1` 恢复开关;源码变更记录只观察到 `CHANGELOG.md` 与 `feed.xml`,未提供实现文件细节。其他发布变化涉及 GitLab MR 识别、Linux Bash 内存限制、网关用户身份转发,以及权限、Session、MCP、Skill 和 Windows 路径修复。

  2. AgentLab

    Qwen Code 0.21.12: ACP Bridge 与 Daemon Session 方案调整

    本版本可观察到 ACP Bridge、Context 压缩引擎及 daemon Session 设计相关代码与文档改动,变化主要落在 `packages/acp-bridge/src/bridge.ts`、`compactionEngine.ts` 和新增的 standalone daemon Session 设计文档。它们表明项目在调整协议桥接、压缩相关实现与独立 Daemon Session 的设计,可能影响 ACP 交互及 Session 管理;现有变更摘要未给出足以还原具体行为的函数或状态细节。官方发布说明为空,代码差异只检查了截断前缀;Runtime Prompt、Tool Schema 与 Static Prompt 的相邻版本比较均不可用。

  3. AgentLab

    Reasonix 1.25.2: Reasonix 1.25.2:规划调研、审批策略与 Session 可靠性调整

    规划器取消固定调研轮数限制,改为持续调研直至提交有效计划或触发安全边界;同时修复最后一个待办完成后未终止的问题,影响计划生成和任务收尾行为。Memory 工具审批开始遵循 Auto、YOLO 与显式 ask/deny 规则;MCP 工具目录在收到列表变更通知后刷新,ACP Thread 状态则提供权威 totalTokens。桌面端也调整了 Session、Workspace 与转录滚动恢复;代码差异只观察到部分变更,不能据此概括未观察部分。

8月14日周五
  1. AgentLab

    Oh My Pi 17.3.4: 17.3.4:修复多处接入、Context 与构建可靠性问题

    本版集中修复远程压缩协商、MCP Session 初始化、Memory 可见性、PDF 处理及若干 Provider 与平台接入路径;Docker 构建改用 cargo/napi-rs 后端,并补充 PDF 转 Markdown 的 native API。行为影响包括让特定凭证、全局 Memory、无图形界面的 macOS Session 和延迟到达的 Terminal 响应恢复可用,并避免 Docker 构建携带大量嵌套产物。Runtime Prompt 的差异仅为工作站环境信息更新,Tool Schema 未变;Static Prompt 当前不可用。代码差异摘要只观察到 9 个文件且被截断,以下源码位置依据可见 keyFiles,其余机制依据官方发布说明。

  2. AgentLab

    Kimi Code 0.36.1: Kimi Code 0.36.1:Web 工作流与 Session 交互调整

    Web 端把 Plan 与 Goal 改为发送前可移除的模式标记,并加入完整 Plan 查看面板;背景 Bash、Subagent 和任务状态也获得筛选与详情视图,让用户能在界面中查看执行进展。Session 可靠性方面,取消 turn 时会一并取消运行中的 `/init`,并修复特定 OpenAI-compatible 服务重编号 Tool Call ID 后的审批卡顿和历史结果错配。源码摘要观察到 CHANGELOG 与构建后的 Web 资源变化;Runtime Prompt/Tool Schema 的相邻捕获一致,Static Prompt 比较不可用。

  3. AgentLab

    Pi 0.84.2: pi 0.84.2:增加 Session 搜索与默认工具配置,重整 Harness 文档并修复流式状态传递

    这版在 TUI 增加全屏 Transcript 搜索,并加入可按全局或项目配置的 `defaultTools`;搜索扫描与 SQLite 后端位于 Agent 的 Session 搜索代码中,工具默认值则由 Coding Agent 配置控制,带来更直接的历史定位和启动工具选择。Session JSONL 编解码器也有修改,官方说明指出 JSON/RPC `message_update` 会累计传递 Usage,且 `triggerTurn: false` 只记录消息而不再干预活动运行。代码差异还显示 Harness 文档从 harness-v2 文档迁移为新版 harness 文档;Runtime Prompt 与 Tool Schema 相邻版本相同,Static Prompt 比较不可用。

  4. AgentLab

    Cline 3.0.55: 延后 Hub 更新,保护活动 Session

    CLI 更新现在会检查 Hub 是否仍有连接:自动更新先记录并等到退出且 Hub 确认没有其他连接后再安装;新版本遇到仍在服务 Session 的 Hub 时则先连接,稍后再切换。实现落在 `apps/cli/src/commands/update.ts`、`sdk/packages/core/src/hub/daemon/index.ts` 和 `sdk/packages/core/src/hub/discovery/index.ts`,降低替换或重启 Hub 导致活动 Session 中断的风险。代码还调整了 Hub 构建身份排序、子进程 Sandbox 回收和流式 Markdown 消息呈现;官方说明也提到原生搜索结果展示及模型目录更新。Runtime Prompt 与 Tool Schema 捕获当前及相邻比较均不可用,Static Prompt 比较也不可用;这些层不能据此判断是否变化。

  5. AgentLab

    Oh My Pi 17.3.3: Gemini 空响应恢复与 Tool Call 重试收紧

    本版围绕 Gemini 回合恢复调整了失败分类和重试路径:thought-only STOP 与空传输分开处理;仅当 MALFORMED_FUNCTION_CALL 中所有 Tool Call 均确认未执行时才重试,并使用有界 final-answer reminder 处理思考后缺少最终输出的回合。发布说明还指出,Terminal 重试错误集中显示并附带尝试 Context,Markdown 孤立闭合围栏渲染及 Hashline 悬空范围分隔符也得到修复。代码概览跨越 v16.3.10 至 v17.3.3 且为截断前缀;可观察到 Bazel 构建与缓存配置新增,但不能据此确定它们与本次 Gemini 修复的关系。Runtime Prompt 的变化仅为工作站 CPU 与日期字段更新。

  6. AgentLab

    Antigravity CLI 1.1.13: Antigravity 1.1.13:Gemini API 直连与 Session 数据可靠性修复

    官方发布说明称,CLI 可通过 GEMINI_API_KEY 和 modelProvider: "gemini" 直接连接 Gemini API,并支持自定义端点;发布也修复了长对话截断、并发改写 Transcript、Session 数据库重复写入及 Subagent 路径校验等问题,改善授权、Context 保留、持久化和安全边界。Runtime Prompt 的 Tool Schema 移除了 multi_replace_file_content,将多处编辑改为对 replace_file_content 的多次调用;同层还加入 read_url_content。当前 Runtime Prompt 捕获显示 11 个工具、Static Prompt 无可用捕获;源码差异包未观察到文件,因此以下实现细节依据官方发布说明陈述。

  7. AgentLab

    Oh My Pi 17.3.2: 修复 Antigravity 请求与重试,并改善 Subagent 交付和文件定位

    Antigravity 现在会丢弃未签名的 thinking blocks、按结构化 429 错误原因选择较长重试延迟,并将用户 System Prompt 原样发送;相关改动集中在 `google-antigravity.ts`、`rate-limit.ts` 和 `gemini-headers.ts`,可减少恢复 Thread 时的 HTTP 400、误判限流和空响应故障。`agent-session.ts` 与 `read-format.ts` 的改动修复 Subagent 结果交付后的 TUI 停滞,并让 read hashline 保留 Workspace 相对路径,降低后续 Edit Tool 定位到同名文件而失败的风险。Runtime Prompt 差异仅为 workstation 系统和硬件信息变化,Tool Schema 无增删改;Static Prompt 比较不可用。

  8. AgentLab

    Claude Code 2.1.232: Claude Code 2.1.232:Subagent 分叉与跨 Session 通信

    Agent 编排扩展了 Subagent 的 Context 继承与后台运行机制,并让 SendMessage 可通过唯一名称直达其他 Session;同时为互动 Session 名称冲突增加自动区分规则,改变了跨 Session 寻址和接收消息的行为。官方发布说明还列出多项权限、Sandbox、Remote Control 与连接可靠性修复,其中 PowerShell 参数覆写、Windows 符号链接写入和嵌套仓库信任修复触及安全边界。Runtime Prompt 中 Agent、ListAgents、SendMessage 和 Artifact 的契约描述也有调整;Static Prompt 不可用,代码概览只观察到 feed.xml 与 CHANGELOG.md。

  9. AgentLab

    Hermes Agent v2026.8.13: Hermes v0.20.1:编排控制、定时监控与工具执行扩展

    代码改动落在 `agent/conversation_loop.py`、`agent/tool_executor.py`、`agent/context_compressor.py` 等模块,覆盖 Agent 编排、Context 压缩、工具执行与凭据处理;Runtime Prompt 同期将多项浏览器操作收敛为 `browser_exec`,并扩展 Cron 和 Subagent 控制契约。这些机制让 Agent 能在后台任务运行时继续工作并管理子任务,以变更检测抑制定时任务空跑,也为语音分块、图像局部放大和更多文档读取提供工具入口。官方将此版本定位为面向下游稳定标签的汇总发布;代码差异只检查了截断前缀。

  10. AgentLab

    Oh My Pi 17.3.1: 扩展工具允许进入最小权限 Session,修复配置发现与跨平台启动问题

    扩展工具发现与 `--tools` allowlist 的衔接得到修复,使扩展注册的工具可以进入最小权限 Session;扩展 Context 也补入 runtime mode,避免 TUI guard 静默关闭扩展 UI。与此同时,模型目录加入 Antigravity 和 Gemini CLI 的 Gemini 3.7 Flash 动态发现及 thinking-level 路由,多个发布修复还覆盖 Claude 配置目录发现、并发更新临时路径、Windows 原生依赖和浏览器探测。Runtime Prompt 仅更换了示例工作站的 CPU 字符串,Static Prompt 当前不可用;源码变更样本未提供,代码位置以下按官方说明中的契约表述。

8月13日周四
  1. AgentLab

    Reasonix 1.25.1: Reasonix 1.25.1:Thread 恢复、状态归属与提供商流式兼容性修复

    桌面端将运行中主题重新附着到 live runtime,并改进历史页水合、侧栏归档及待办关闭后的 Thread 状态持久化;相关实现落在 `desktop/topic_live_runtime.go`、`desktop/session_canonical_retarget.go` 和 `desktop/todo_dismissal.go`,减少恢复时打开旧副本、历史缺页或状态回退。Provider 层调整官方 DeepSeek 输出上限和 Anthropic 兼容网关的流结束处理,`internal/provider/anthropic/stream_eof_test.go` 与 `internal/provider/anthropic/web_search_stream.go` 覆盖相关流式路径;Goal 验证循环也增加重复完成申报的停止行为。Runtime Prompt 与 Tool Schema 的当前捕获和相邻比较均不可用,Static Prompt 比较也不可用,因此这些层不能用于判定版本差异。

  2. AgentLab

    DeepSeek Harness 0.1.0-rc.2: 新增向用户提问能力并调整 Subagent 后台调度

    System Prompt 补充 DeepSeek Harness Web GUI、工作目录与构建验证约束;`ask_user_question` 为 Agent 增加在缺少确认或信息时向用户提问的 Tool Call,`subagent_fork` 则改为默认后台运行。整体行为更强调先确认关键输入,并让独立委派可以并行推进;工具集同时移除 `str_replace_editor`,具体编辑能力变化无法仅由其名称判断。

  3. AgentLab

    Claude Code 2.1.231: Artifact 下载能力与用户私有数据路径扩展;MCP OAuth 修复

    Artifact 的发布契约扩展了文件交付和按用户隔离的数据路径:Runtime Prompt 描述通过 capability 声明下载能力,并规定 `data/users/` 与 `me` 的解析方式;共享数据库之外,Artifact 因而可向查看者提供文件,并寻址其个人数据。与此同时,Prompt 补充了查看器 Sandbox 会拦截页面主动下载的限制,引导 Agent 使用受支持的 capability;官方发布说明另确认修复了预注册 OAuth Client 场景中的 MCP 重定向 URI 不匹配。官方代码概览只观察到 `feed.xml` 与 `CHANGELOG.md` 的修改,未提供实现样例,无法据此定位 OAuth 修复代码。

  4. AgentLab

    MiMo Code 0.1.12: MiMo Code 0.1.12:强化 Bash 命令边界与凭据环境处理

    Bash 执行逻辑与凭据环境处理是本版可见的实现重点:`packages/opencode/src/tool/bash.ts` 有修改,新增 `packages/opencode/src/util/credential-env.ts`,并分别更新 Bash、凭据环境和 Session 重试测试。代码变化显示执行与认证周边的局部可靠性得到调整;Runtime Prompt 的自治安全边界、Messages 与 Tools 也有差异,其中 Tool Schema 仅 `skill` 被标记为修改,工具数量仍为 16。官方发布说明为空,Static Prompt 当前不可用。

  5. AgentLab

    Oh My Pi 17.3.0: 17.3.0:按实际界面验证,并保留近期工具结果

    Agent 的验证流程按界面类型分流:Web UI 通过浏览器检查,TUI/CLI 启动实际程序检查交互、输出或状态;没有合适运行时工具时改用行为测试或 smoke test。这一规则落在 Runtime Prompt 的 `5. Verify`,影响交付前需要提供的验证证据。源码与发布说明还显示 `/shake` 会保留一小段近期工具结果,Anthropic Prompt 缓存增加滚动刷新;这些机制分别影响工作 Context 延续和缓存前缀保持。

  6. AgentLab

    Cline 3.0.54: Claude Code Provider 接入原生工具与权限设置

    Claude Code Provider 改为运行自身原生工具,并以 Workspace 目录锚定 Session、加载 `~/.claude` 和项目设置,使文件编辑与命令执行分别遵循自动批准和 Claude 设置门控。代码变更同时覆盖 Hub daemon 升级与关闭、WebSocket 服务及聊天工具摘要组件,发布说明还记录了截断 Tool Call JSON 拒绝、流式索引处理和 Token 统计修正。