生产级Agent(21):多租户隔离与数据边界
前二十篇已经把生产级 Agent 从 Planner、Tool、Memory、Checkpoint、Human-in-the-Loop、多 Agent、Sandbox、Eval、Control Plane、Registry、Delegated Authority、Audit Ledger、Replay 一直推进到 SLO 与错误预算。
codex mcp-server退场:迁移App Server别只改命令
现在最重要的事情不是把命令换掉,而是先确认它背后承载了什么协议责任。
GPT-5.6进Kiro:82%成本降幅怎么测
OpenAI 8 月 24 日公布 GPT-5.6 Sol、Terra、Luna 已进入 AWS Kiro,并给出一个很具体的数据:在 Terminal-Bench 2.1 上,**GPT-5.6 Terra 在 Kiro 环境里完成成功任务的成本约下降 82%**。
语音Agent怎么进CI:ADK Live Eval实战
Google ADK 在 8 月 24 日新增原生 Live Evaluation 后,这类问题终于可以进入自动化测试:测试用户不再只是 JSON 里的文本,而是由模拟用户根据 Persona 和 Conversation Plan 生成真实语音,再流式送给 Live Agent;Agent 的语音回复、Tool Execution 和多轮 Trajectory 可以一起评分,并且可以从 CLI
Agent权限为什么必须动态收缩?
它可能在同一个 Run 里先查邮件、再读 CRM、再调用数据库,最后准备触发外部 API。权限需求会随着任务阶段变化,而且 Tool 本身还可能受到 Prompt Injection、Tool Poisoning 和上下文污染影响。
S3数据不搬家,Agent先补语义层
Google Cloud 8 月 24 日公开的 SOAP Architecture 提供了另一条路径:**数据可以继续留在 S3 等原位置,先把访问、语义和业务关系层建立起来,再让 Agent 使用。**
Spring Boot实现语音Agent发布门禁
语音 Agent 的评测真正接进 CI 以后,下一个问题马上出现:
生产级Agent(20):SLO与错误预算
生产级 Agent 做到第 20 篇,系统已经具备 Planner、Tool、Memory、Checkpoint、Human-in-the-Loop、多 Agent、Sandbox、Eval、Control Plane、Registry、Delegated Authority、Audit Ledger、Replay 和 Failure Forensics。
Agent发消息前,审批为什么必须绑定收件人?
真正接进 Agent 以后,它和 `search_docs` 完全不是一个风险等级,因为它会在外部世界留下不可逆结果:收件人会看到消息,群聊可能触发后续讨论,错误发送甚至可能泄露客户信息。
Codex接入GitLab后,MR自动审查会漏掉什么?
OpenAI 8 月 19 日把 GitLab Support 放进 Beta:可以连接 GitLab Project、为项目创建 Codex Cloud Environment,从 Issue 或 Merge Request 里通过 `@codex` 发起任务,也可以做一次性或自动 Merge Request Review。
CHIVE实验证明:看激活值不等于理解模型
Anthropic 8 月 21 日公布的 CHIVE 结果给了一个很不舒服的反例。
漏洞没修也能关闭?Mitigated该怎么管
GitHub 8 月 20 日给 Code Scanning 新增了一个专门的 dismissal reason:
CodeQL 2.26.3:Actions污点边界变了
CodeQL 2.26.3 这次更新里,我最关注的不是新增了多少查询,而是 GitHub Actions 的“可信输入边界”发生了几处很具体的调整。
Spring Boot实现漏洞补偿控制台
安全扫描告警最容易出现的治理断层,是“代码没修,但外层控制已经降低风险”这类状态。
生产级Agent(19):执行回放与故障取证
前十八篇已经把生产级 Agent 的执行、权限、审计和治理链条搭起来:Run、Planner、Tool、Checkpoint、Approval、Capability、Delegated Authority、Audit Ledger 都有了。但真正发生线上事故以后,团队很快会遇到一个更难的问题:
生产级Agent(18):审计账本与可解释执行
前十七篇已经把生产级 Agent 从 Planner、Tool Calling、Memory、Checkpoint、Human-in-the-Loop、多 Agent、安全沙箱、质量门禁、Control Plane、Capability Registry 一直推进到 Agent Identity 与 Delegated Authority。系统现在已经能回答:有哪些 Agent、有哪些能力、谁能调
Copilot进Teams后,Agent协作不该只剩聊天记录
一个 Agent 任务如果持续 20 分钟,参与者有 5 个人,期间改了 8 个文件、跑了 3 轮测试、请求了一次审批,最后只把这些信息折叠成几十条聊天消息,协作成本其实并没有消失,只是从“做事”转移成了“翻记录”。
Codex App Server:Agent协议为什么选双向JSON-RPC
把一个 Agent 嵌进 IDE、桌面应用或者 Web,不是简单暴露一个 `/chat` 接口就够了。
Claude文本水印:没有隐藏字符,检测靠什么?
Anthropic 在 8 月 14 日公开 Claude 文本水印方案时,明确否定了这两种理解。
Prompt也要编译:把Agent指令做成CI构建产物
生产 Agent 的 System Prompt 一旦超过几百行,最危险的事情通常不是“模型记不住”,而是团队已经无法确定:**这一句规则到底从哪里来的,改它会影响哪些 Agent,线上正在跑的文本是不是 Git 里的那一份。**