AI Agent控制面正在成形
八条信号同时指向一件事:会话、评测、缓存、交易与故障域,正被写成 Agent 系统里的明确控制面。
RISC机器说明
RISC = 生产级 Agent / 机器人身体的四个系统
一个真正能上生产的 Agent,不能只有大脑。它还要持续行动、扛住故障、抵御越权,并进入真实组织协作。
AI Agent雷达
Claude 与 Qwen 把会话交给控制面
模型切换钩子、缓存重建成本、命名任务与 daemon API 共同说明,长会话正在获得权限、身份和恢复语义。
Microsoft 与 Deep Agents 接上证据链
检查点不可变、续传校验与 rubric 钩子把“是否完成”推进到“依据什么恢复、按什么标准验收”。
Mistral 与 AWS 重写放置逻辑
一个把请求送到真正持有前缀的 Rank,一个把副本分散到故障域;性能和可靠性都不再只是模型属性。
值得关注的新功能
Claude Code 2.1.251 把模型切换与远程子任务纳入控制面
发生了什么:Claude Code 2.1.251 新增可阻断、确认或标注模型切换的前后置钩子,并在恢复会话时提供缓存陈旧度与重建成本;前台子 Agent 的工具调用可实时传给 Remote Control。版本同时修复授权后替换符号链接逃逸、插件路径穿越等安全问题。
为什么值得关注:模型切换、远程观察与权限校验开始共享同一执行控制面,减少长会话在切换和恢复时的盲区。
适合谁看:用 Claude Code 运行长会话、远程编码或多模型切换的研发团队。
Qwen Code 0.22.3 让一个聊天承载八个持久任务
发生了什么:Qwen Code 0.22.3 在 Channels 中加入按所有者隔离的命名会话,一个聊天最多管理八个持久任务;独立 daemon API 可创建、列出、恢复、归档和删除顶层会话。版本还补上 PR 状态绑定、评审修复约束、文件标记投影与跨平台子进程清理。
为什么值得关注:编码 Agent 的基本单位正从单轮终端变成可命名、可恢复、可归档并与代码审查状态联动的任务集合。
适合谁看:在聊天渠道、Web Shell 或后台守护进程中管理并行编码任务的团队。
Google AI Mode 从行程建议走到机票提醒与酒店下单
发生了什么:Google 为 AI Mode 增加机票价格提醒,覆盖超过 300 家航空公司与旅行网站,并扩展到 180 多个国家和地区;积分与里程价格查询同步全球开放。美国英语用户还可在 AI Mode 内比较酒店、查看取消政策,并用 Google Pay 完成预订。
为什么值得关注:搜索型 Agent 正从生成建议进入价格监控、资格计算和交易闭环,产品责任也延伸到库存、条款与付款。
适合谁看:做旅行、电商、搜索、支付和高意图消费 Agent 的产品团队。
GitHub开源发现
Stars为成稿时的关注度快照,不代表质量排名。许可证按官方仓库与模型卡准确标注。
Microsoft Agent Framework 1.16 固化后台等待与检查点边界
发生了什么:Microsoft Agent Framework Python 1.16.0 新增首个后台 Agent 任务完成的可配置等待超时,并允许程序化设置 OpenTelemetry 服务元数据、资源属性和 OTLP。版本还保留后端持有的会话快照,校验增量续传输入,防止工作流检查点在存储实现之外被修改。
为什么值得关注:后台任务、遥测、会话续传和检查点不可变性被放进同一框架版本,直接影响故障定位与恢复可信度。
适合谁看:用 Python 构建后台 Agent、可观测工作流和多提供方会话续传的平台团队。
OpenHands 1.16 用显式技能清单收紧 Agent Canvas
发生了什么:OpenHands 1.16.0 将默认全开的技能目录改为显式允许清单,新增模型提供方选择、模型切换开关、自动化运行阶段和 Canvas Extensions 前端;同时提供 Linux 桌面安装构建,并修正本地后端、工作目录、轮询与凭据显示等边界。
为什么值得关注:自托管 Agent 控制台不只要连接更多编码后端,还需要把技能启用、模型选择和自动化状态变成可见配置。
适合谁看:部署 OpenHands、Agent Canvas 或多编码后端自托管控制台的团队。
Mistral 路由器开始按数据并行 Rank 命中 KV 缓存
发生了什么:Mistral 在公开 llm-d Router 分支加入数据并行感知的 KV 事件索引与前缀评分,使同一 Pod 内各 Rank 的缓存不再被错误合并;调度器可把请求固定到命中缓存的 Rank,并清除客户端传入的 Rank 头,避免外部绕过缓存感知放置。
为什么值得关注:共享端口的数据并行推理若只按 Pod 路由,会把看似命中的前缀送到错误 Rank,重新计算并放大首 token 延迟。
适合谁看:运行 vLLM、SGLang、llm-d 或大规模前缀缓存推理集群的基础设施团队。
全球技术与市场观察
Deep Agents 0.7.11 为 SDK 接入 Rubric 评分钩子
发生了什么:LangChain 的 Deep Agents 0.7.11 新增 SDK 集成钩子,让外部 rubric grader 能进入 Agent 运行后的评测链。这个小版本没有扩大模型或工具表面,而是提供一个明确接点,把任务结果交给按标准项执行的评分器。
为什么值得关注:Agent 评测需要从离线脚本进入可复用 SDK 生命周期,才能把任务标准、运行证据和回归结果稳定关联。
适合谁看:维护 Agent SDK、回归评测、质量门禁和任务验收体系的工程团队。
Salesforce 用 SageMaker 新调度策略补齐 Agentforce 多可用区
发生了什么:AWS 披露 Salesforce Agentforce 使用 AvailabilityZoneBalance 与 SPREAD 策略,让模型副本按最大不平衡值分散到多可用区;扩缩容继续维持分布,后台 CONSOLIDATION 会整理偏斜副本。
为什么值得关注:共享 GPU 能降低成本,但默认放置可能把副本集中到单一区域故障域;Agent 服务的高可用必须进入调度约束。
适合谁看:在 SageMaker 上承载企业 Agent、共享 GPU 推理和多可用区 SLA 的平台团队。
来源
- Claude Code:Claude Code 2.1.251 把模型切换与远程子任务纳入控制面 官方发布
- Qwen Code:Qwen Code 0.22.3 让一个聊天承载八个持久任务 官方发布
- Google Search AI Mode:Google AI Mode 从行程建议走到机票提醒与酒店下单 官方公告
- Microsoft Agent Framework:Microsoft Agent Framework 1.16 固化后台等待与检查点边界 官方开源发布
- OpenHands:OpenHands 1.16 用显式技能清单收紧 Agent Canvas 官方开源发布
- Mistral llm-d Router:Mistral 路由器开始按数据并行 Rank 命中 KV 缓存 官方仓库更新
- Deep Agents:Deep Agents 0.7.11 为 SDK 接入 Rubric 评分钩子 官方开源发布
- AWS and Salesforce Agentforce:Salesforce 用 SageMaker 新调度策略补齐 Agentforce 多可用区 官方公告
