Jalapeño推理芯片:别只看3.6倍低延迟
OpenAI 今天公布 Jalapeño 首批公开测试结果。它是 OpenAI 第一款自研推理芯片,测试覆盖 GPT‑OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T。官方给出的核心结果是:
Webhook触发Agent:别把轮询直接换成事件
ChatGPT Work 8 月 25 日开始支持基于应用更新触发 Scheduled Task,目前公开支持:
Ray 2.58沙箱:Agent代码别再直接跑容器
让 Coding Agent 生成一段 Python,然后直接:
法律Agent最难的不是RAG,是Matter隔离
这类问题即使答案“很正确”,也可能已经越过保密义务和 Ethical Wall。
金融Agent如何证明这份报告用了哪版数据?
Google Cloud 8 月 25 日发布 Gemini Enterprise for Financial Services 时,把几个能力摆在了模型之外:
Spring Boot实现Webhook Agent任务路由
下面直接用 Spring Boot 搭一个最小 Webhook Agent Router,把外部事件先变成可靠任务,再交给 Agent。
生产级Agent(21):多租户隔离与数据边界
前二十篇已经把生产级 Agent 从 Planner、Tool、Memory、Checkpoint、Human-in-the-Loop、多 Agent、Sandbox、Eval、Control Plane、Registry、Delegated Authority、Audit Ledger、Replay 一直推进到 SLO 与错误预算。
codex mcp-server退场:迁移App Server别只改命令
现在最重要的事情不是把命令换掉,而是先确认它背后承载了什么协议责任。
GPT-5.6进Kiro:82%成本降幅怎么测
OpenAI 8 月 24 日公布 GPT-5.6 Sol、Terra、Luna 已进入 AWS Kiro,并给出一个很具体的数据:在 Terminal-Bench 2.1 上,**GPT-5.6 Terra 在 Kiro 环境里完成成功任务的成本约下降 82%**。
语音Agent怎么进CI:ADK Live Eval实战
Google ADK 在 8 月 24 日新增原生 Live Evaluation 后,这类问题终于可以进入自动化测试:测试用户不再只是 JSON 里的文本,而是由模拟用户根据 Persona 和 Conversation Plan 生成真实语音,再流式送给 Live Agent;Agent 的语音回复、Tool Execution 和多轮 Trajectory 可以一起评分,并且可以从 CLI
Agent权限为什么必须动态收缩?
它可能在同一个 Run 里先查邮件、再读 CRM、再调用数据库,最后准备触发外部 API。权限需求会随着任务阶段变化,而且 Tool 本身还可能受到 Prompt Injection、Tool Poisoning 和上下文污染影响。
S3数据不搬家,Agent先补语义层
Google Cloud 8 月 24 日公开的 SOAP Architecture 提供了另一条路径:**数据可以继续留在 S3 等原位置,先把访问、语义和业务关系层建立起来,再让 Agent 使用。**
Spring Boot实现语音Agent发布门禁
语音 Agent 的评测真正接进 CI 以后,下一个问题马上出现:
生产级Agent(20):SLO与错误预算
生产级 Agent 做到第 20 篇,系统已经具备 Planner、Tool、Memory、Checkpoint、Human-in-the-Loop、多 Agent、Sandbox、Eval、Control Plane、Registry、Delegated Authority、Audit Ledger、Replay 和 Failure Forensics。
Agent发消息前,审批为什么必须绑定收件人?
真正接进 Agent 以后,它和 `search_docs` 完全不是一个风险等级,因为它会在外部世界留下不可逆结果:收件人会看到消息,群聊可能触发后续讨论,错误发送甚至可能泄露客户信息。
Codex接入GitLab后,MR自动审查会漏掉什么?
OpenAI 8 月 19 日把 GitLab Support 放进 Beta:可以连接 GitLab Project、为项目创建 Codex Cloud Environment,从 Issue 或 Merge Request 里通过 `@codex` 发起任务,也可以做一次性或自动 Merge Request Review。
CHIVE实验证明:看激活值不等于理解模型
Anthropic 8 月 21 日公布的 CHIVE 结果给了一个很不舒服的反例。
漏洞没修也能关闭?Mitigated该怎么管
GitHub 8 月 20 日给 Code Scanning 新增了一个专门的 dismissal reason:
CodeQL 2.26.3:Actions污点边界变了
CodeQL 2.26.3 这次更新里,我最关注的不是新增了多少查询,而是 GitHub Actions 的“可信输入边界”发生了几处很具体的调整。
Spring Boot实现漏洞补偿控制台
安全扫描告警最容易出现的治理断层,是“代码没修,但外层控制已经降低风险”这类状态。