AI Agent工具开始长出系统感
这一期看八个真正影响使用体验的变化:多任务、恢复、安全凭据、可观察记忆、本地推理与机密 GPU。
RISC机器说明
RISC = 生产级 Agent / 机器人身体的四个系统
一个真正能上生产的 Agent,不能只有大脑。它还要持续行动、扛住故障、抵御越权,并进入真实组织协作。
AI Agent雷达
继续工作前,系统开始先确认状态是否可信
Codex 管多会话,Claude Code 处理停机停放,Qwen 则在恢复审查前核对代码版本。
记忆、凭据和 Skills 正从黑箱变成可管理对象
E2B 隐藏凭据原值,OpenViking 暴露检索路径,AI-Infra-Guard 补上安装前扫描。
本地速度与数据中心可信度正在同时进化
oMLX 把长上下文缓存延伸到 Mac SSD,NVIDIA 则把机密计算推进到 HGX B300 多 GPU。
值得关注的新功能
Codex 0.149 把多会话任务变成可排队的工作流
发生了什么:Codex 0.149 新增 agents 面板和 codex queue,可搜索、启动、打开、重命名与停止任务,并向本地或远程会话投递消息;同时修复空闲唤醒、权限恢复和 WebRTC 重连。
为什么值得关注:AI 编程工具开始从单窗口对话转向可寻址、可排队、可恢复的多任务工作台。
适合谁看:同时维护多个仓库、远程任务或长时间 coding agent 流程的团队。
Claude Code 2.1.238 让自托管任务在停机前先安稳停放
发生了什么:自托管 runner 收到 SIGTERM 后会在宽限期内继续服务已连接会话,到期再 park 并退出;新版也修复慢轮询或丢包导致健康会话被误交接的问题。
为什么值得关注:长任务不仅怕崩溃,也怕被误判崩溃;宽限期和停放机制让交接边界更清楚。
适合谁看:自托管 Claude Code、频繁维护 runner,或需要保留长任务的团队。
E2B 2.43 让沙箱里的秘密可以使用但不能读回
发生了什么:E2B Secrets Management 允许创建或更新秘密值,但读取接口只返回元数据;运行时通过占位符解析当前值,未注册 IAM token 会在使用时直接报错。
为什么值得关注:Agent 可以拿凭据做事,却不能把原值读出、写进日志或带回对话。
适合谁看:把 GitHub、数据库、云端 API 或内部系统交给 Agent 调用的团队。
Qwen Code 0.21.15 在恢复审查前先确认代码没有变
发生了什么:/review 与 CI 重试新增 --resume,但只有 PR head 未变化时才继续中断审查;新版也修复 /rewind 丢历史、重复 tool-call ID,并保存 Web Shell 附件。
为什么值得关注:恢复不能只看 Agent 记忆,还要先确认现实世界没有变化。
适合谁看:使用 AI 做 PR 审查、CI 修复或长时间代码任务的维护者。
GitHub开源发现
OpenViking 用可浏览文件系统管理记忆、资料和 Skills
发生了什么:OpenViking 把 memories、resources 和 skills 放进统一的 viking:// 文件系统,用 L0 摘要、L1 概览、L2 详情按需加载,并保留每次检索路径。
为什么值得关注:记忆从黑盒向量搜索变成可以 ls、tree、find 的可观察上下文库。
适合谁看:使用 OpenClaw、Codex、Claude Code,或研究 Agent 记忆与 RAG 的人。
腾讯 AI-Infra-Guard 把 Agent、MCP 和 Skills 放进同一套扫描工具
发生了什么:腾讯朱雀实验室的开源红队平台同时覆盖 OpenClaw、Agent 工作流、MCP Server、Skills、基础设施 CVE 与越狱评估;v4.5.2 增加多项绕过和工具白名单检测。
为什么值得关注:Skills 与 MCP 正成为 Agent 的软件供应链,却常常缺少安装前检查。
适合谁看:会安装第三方 Skills、MCP 服务或管理企业 Agent 工具链的人。
oMLX 让 Mac 本地模型拥有 RAM 与 SSD 两层 KV 缓存
发生了什么:oMLX 为 Apple Silicon 提供连续批处理、多模型管理、OpenAI/Anthropic 兼容 API,以及热 RAM、冷 SSD 两层 KV cache;服务重启后仍可复用匹配前缀。
为什么值得关注:把缓存延伸到 SSD,可减少本地长上下文反复预填充的等待。
适合谁看:希望在 M 系列 Mac 本地运行编程模型、VLM 或 embedding 的团队。
全球技术与市场观察
NVIDIA 机密容器 1.1 支持 HGX B300 多 GPU 工作负载
发生了什么:Confidential Containers 1.1.0 新增 HGX B300 单、多 GPU passthrough,支持 Ubuntu 26.04、Kata Containers 4.0.0、containerd 2.3.x,并扩大 OpenShift GA 覆盖。
为什么值得关注:敏感 AI 工作负载的“计算中保护”正走向新一代多 GPU 系统。
适合谁看:运行金融、医疗、主权 AI 或模型 IP 保护工作负载的平台团队。
来源
- OpenAI Codex:Codex 0.149 把多会话任务变成可排队的工作流 官方发布
- Anthropic Claude Code:Claude Code 2.1.238 让自托管任务在停机前先安稳停放 官方发布
- E2B:E2B 2.43 让沙箱里的秘密可以使用但不能读回 官方发布
- Qwen Code:Qwen Code 0.21.15 在恢复审查前先确认代码没有变 官方发布
- Volcano Engine OpenViking:OpenViking 用可浏览文件系统管理记忆、资料和 Skills 官方仓库
- Tencent Zhuque Lab AI-Infra-Guard:腾讯 AI-Infra-Guard 把 Agent、MCP 和 Skills 放进同一套扫描工具 官方仓库
- oMLX:oMLX 让 Mac 本地模型拥有 RAM 与 SSD 两层 KV 缓存 官方仓库
- NVIDIA Confidential Containers:机密容器 1.1 支持 HGX B300 多 GPU 工作负载 官方文档
