智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
Webhook触发Agent:别把轮询直接换成事件

Webhook触发Agent:别把轮询直接换成事件

ChatGPT Work 8 月 25 日开始支持基于应用更新触发 Scheduled Task,目前公开支持:

72 13 0 21小时前
codex mcp-server退场:迁移App Server别只改命令

codex mcp-server退场:迁移App Server别只改命令

现在最重要的事情不是把命令换掉,而是先确认它背后承载了什么协议责任。

141 22 0 1天前
Agent发消息前,审批为什么必须绑定收件人?

Agent发消息前,审批为什么必须绑定收件人?

真正接进 Agent 以后,它和 `search_docs` 完全不是一个风险等级,因为它会在外部世界留下不可逆结果:收件人会看到消息,群聊可能触发后续讨论,错误发送甚至可能泄露客户信息。

217 39 0 2天前
Codex接入GitLab后,MR自动审查会漏掉什么?

Codex接入GitLab后,MR自动审查会漏掉什么?

OpenAI 8 月 19 日把 GitLab Support 放进 Beta:可以连接 GitLab Project、为项目创建 Codex Cloud Environment,从 Issue 或 Merge Request 里通过 `@codex` 发起任务,也可以做一次性或自动 Merge Request Review。

225 33 0 2天前
GitHub 这次 7 小时 47 分钟事故,最值得抄进自己系统的不是“多加机器”,而是先把 Retry Loop 关进笼子

GitHub 这次 7 小时 47 分钟事故,最值得抄进自己系统的不是“多加机器”,而是先把 Retry Loop 关进笼子

这次事故持续 **7 小时 47 分钟**,影响了 github.com、认证、GitHub Actions、API、Pull Request、Issue 和 Copilot。

459 69 0 5天前
MCP Server 真上云以后,我最不建议做的事就是继续用 API Key:Cloud Run 这套 OAuth + IAM 值得照着抄

MCP Server 真上云以后,我最不建议做的事就是继续用 API Key:Cloud Run 这套 OAuth + IAM 值得照着抄

昨天 Google Cloud 的 Wednesday Build Hour 主题之一就是:

495 81 0 6天前
Claude 连续两天出故障以后,我重新看了一遍“多模型容灾”这件事

Claude 连续两天出故障以后,我重新看了一遍“多模型容灾”这件事

Anthropic Status Page 记录的范围包括 claude.ai、platform.claude.com、Claude API、Claude Code 和 Claude Cowork。

633 110 0 8天前
离线评测分数很高,线上用户为什么仍然不满意?数据分布与任务成功率排查

离线评测分数很高,线上用户为什么仍然不满意?数据分布与任务成功率排查

离线集可能过于干净、静态和均衡,无法覆盖线上噪声、权限、长对话、超时和真实业务结果。

772 131 0 11天前
LLM-as-a-Judge评分忽高忽低?位置偏差、长度偏差与校准排查

LLM-as-a-Judge评分忽高忽低?位置偏差、长度偏差与校准排查

评审模型会受答案顺序、长度、措辞、自身模型偏好和Rubric模糊影响。

761 116 0 11天前
Code Interpreter临时文件为什么泄露到其他任务?工作目录与生命周期排查

Code Interpreter临时文件为什么泄露到其他任务?工作目录与生命周期排查

多个任务复用容器、工作目录或缓存时,前一个用户生成的文件可能被后续任务读取。

978 145 0 12天前
Browser Agent遇到验证码和登录循环怎么办?会话、人工接管与站点策略排查

Browser Agent遇到验证码和登录循环怎么办?会话、人工接管与站点策略排查

浏览器Agent在验证码、MFA、会话过期和反自动化策略前可能不断刷新或重试。

948 145 0 12天前
多Agent协作时为什么总是传递旧上下文?状态版本与消息边界排查

多Agent协作时为什么总是传递旧上下文?状态版本与消息边界排查

子Agent读取的状态可能是任务开始时快照,而不是其他Agent刚更新的最新结果。

981 148 0 13天前
并行Sub-Agent为什么让Token成本暴涨?并发、上下文复制与预算排查

并行Sub-Agent为什么让Token成本暴涨?并发、上下文复制与预算排查

并行执行会复制System Prompt、工具Schema、历史和检索上下文,Agent数量翻倍时成本可能超过线性增长。

1044 165 0 13天前
Agent从Checkpoint恢复后为什么重复调用工具?步骤提交与副作用幂等排查

Agent从Checkpoint恢复后为什么重复调用工具?步骤提交与副作用幂等排查

Checkpoint保存时间点不正确时,恢复后会重新执行已经产生副作用的工具。

1131 189 0 14天前
Human-in-the-Loop审批超时后任务丢失?等待状态与恢复令牌排查

Human-in-the-Loop审批超时后任务丢失?等待状态与恢复令牌排查

人工审批可能持续小时或数天,不能依赖HTTP连接、内存Future或临时线程等待。

1214 178 0 14天前
HNSW索引内存为什么越来越高?参数、Payload索引与副本排查

HNSW索引内存为什么越来越高?参数、Payload索引与副本排查

向量数量增长后,HNSW图、向量数据、Payload索引、副本和缓存都会消耗内存。只调整一个参数往往无法解决。

1256 200 0 16天前
向量量化后Recall突然下降?Scalar、Product与Binary Quantization排查

向量量化后Recall突然下降?Scalar、Product与Binary Quantization排查

量化能够降低内存和提升速度,也会引入距离误差。下降是否可接受取决于向量分布、候选数和重排策略。

1294 207 0 16天前
GraphRAG检索结果为什么又多又乱?实体合并、社区摘要与路径约束排查

GraphRAG检索结果为什么又多又乱?实体合并、社区摘要与路径约束排查

GraphRAG能够沿关系扩展证据,也容易因为实体重复、关系过密和无边界遍历返回大量噪声。

1264 194 0 17天前
Agentic RAG为什么在多个检索工具之间死循环?终止条件与进度检测排查

Agentic RAG为什么在多个检索工具之间死循环?终止条件与进度检测排查

Agent在向量检索、网页搜索和数据库工具之间反复调用,通常是缺少可验证目标、进度状态和工具调用预算。

1521 227 0 17天前
RAG答案有引用但引用根本不支持结论?Claim-Evidence校验排查

RAG答案有引用但引用根本不支持结论?Claim-Evidence校验排查

真实存在的文档编号并不意味着结论被该文档支持,需要进行Claim级证据校验。

1303 205 0 18天前

精选推荐

1 ReAct、Plan-Execute-Review与状态图Agent怎么选? 1262 2 Agent Planner输出计划存在循环依赖?DAG校验与自动修复排查 1225 3 Human-in-the-Loop审批超时后任务丢失?等待状态与恢复令牌排查 1214 4 手搓生产级 AI Agent 系统(8):Planner、Executor与Reviewer闭环 1187 5 Reviewer为什么让Agent无限修改?接受阈值、最大轮次与差异检测排查 1166 6 Agent从Checkpoint恢复后为什么重复调用工具?步骤提交与副作用幂等排查 1131 7 用Python实现Planner-Executor-Reviewer状态机Agent 1078 8 手搓生产级 AI Agent 系统(9):Checkpoint、Human-in-the-Loop与断点恢复 1073 9 数据库Checkpoint、事件溯源与工作流引擎怎么选?Agent持久化指南 1070 10 用Spring Boot搭建Agent Checkpoint服务:保存、恢复、审批与重放 1066 11 并行Sub-Agent为什么让Token成本暴涨?并发、上下文复制与预算排查 1044 12 Supervisor、Handoff与Blackboard怎么选?多Agent协作模式指南 990 13 多Agent协作时为什么总是传递旧上下文?状态版本与消息边界排查 981 14 Code Interpreter临时文件为什么泄露到其他任务?工作目录与生命周期排查 978 15 手搓生产级 AI Agent 系统(10):多Agent协作、Supervisor与共享状态 971 16 手搓生产级 AI Agent 系统(11):代码与浏览器沙箱、安全执行与风险控制 965 17 Browser Agent遇到验证码和登录循环怎么办?会话、人工接管与站点策略排查 948 18 用Spring Boot实现预算感知的多Agent编排器 923 19 用Spring Boot搭建Agent安全执行网关:代码沙箱、浏览器会话与审计 912 20 容器沙箱、MicroVM与远程执行服务怎么选?Agent代码执行架构指南 894