智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
50+ 个 Agent 上线、310 人在用:ABC Legal 最值得抄的不是 Claude,而是把 Agent 当软件管理

50+ 个 Agent 上线、310 人在用:ABC Legal 最值得抄的不是 Claude,而是把 Agent 当软件管理

昨天 Anthropic 公布了一个我觉得很值得企业团队认真看的案例。

613 92 0 8天前
Gemini 3.7 Flash 刚发布:我更在意的不是跑分,而是 $0.75 输入价把 Agent 成本线往下压了一截

Gemini 3.7 Flash 刚发布:我更在意的不是跑分,而是 $0.75 输入价把 Agent 成本线往下压了一截

8 月 13 日,Google 发布了 Gemini 3.7 Flash。

720 118 0 9天前
8月26日 o3 从 ChatGPT 下线:别急着改 API,你真正要检查的是这 6 类使用习惯

8月26日 o3 从 ChatGPT 下线:别急着改 API,你真正要检查的是这 6 类使用习惯

OpenAI 已确认:**o3 将在 2026 年 8 月 26 日从 ChatGPT 退役**。这次变化只影响 ChatGPT 中的模型选择,OpenAI 官方同时明确说明,API 不受此次退役影响。

654 98 0 9天前
Kimi K3 权重放出来以后,国产大模型竞争开始变成另一场游戏

Kimi K3 权重放出来以后,国产大模型竞争开始变成另一场游戏

7 月底 Kimi K3 的完整权重公开后,我觉得国产大模型的竞争已经出现了一个明显变化。

749 119 0 9天前
SWE-Bench 高就一定会写项目?一篇 GH200 实测给了三个反例

SWE-Bench 高就一定会写项目?一篇 GH200 实测给了三个反例

这两年选 Coding Model,SWE-Bench 几乎成了必看榜单。

755 105 0 9天前
Agent Planner输出计划存在循环依赖?DAG校验与自动修复排查

Agent Planner输出计划存在循环依赖?DAG校验与自动修复排查

Planner生成的步骤可能互相依赖,导致执行器无法找到起点或反复等待。

1225 187 0 15天前
ReAct、Plan-Execute-Review与状态图Agent怎么选?

ReAct、Plan-Execute-Review与状态图Agent怎么选?

三种Agent架构分别强调即时推理、显式计划和可持久化状态图,适合不同任务复杂度。

1262 196 0 15天前
Reviewer为什么让Agent无限修改?接受阈值、最大轮次与差异检测排查

Reviewer为什么让Agent无限修改?接受阈值、最大轮次与差异检测排查

Reviewer如果只有“继续改进”而没有可判定Rubric和接受阈值,会让执行器无限返工。

1166 184 0 15天前
用Python实现Planner-Executor-Reviewer状态机Agent

用Python实现Planner-Executor-Reviewer状态机Agent

实现带计划校验、步骤执行、Reviewer反馈、局部重试和最终汇总的状态机Agent。

1078 177 0 15天前
手搓生产级 AI Agent 系统(8):Planner、Executor与Reviewer闭环

手搓生产级 AI Agent 系统(8):Planner、Executor与Reviewer闭环

在已有任务规划器之上实现DAG校验、步骤执行、局部审校、状态更新和终止策略。

1187 192 0 15天前
欧盟AI法案进入下一阶段:企业AI应用需要补齐哪些治理能力?

欧盟AI法案进入下一阶段:企业AI应用需要补齐哪些治理能力?

随着欧盟AI法案进入新的实施阶段,企业AI项目不能再把合规理解为“在页面上加一句AI生成提示”。OpenAI于2026年7月31日公开说明其对通用人工智能模型行为准则和AI生成内容透明度行为准则的支持,并再次强调安全评测、风险治理、来源标识、事件响应和持续更新。对于使用第三方大模型构建客服、知识库、Agent和内容生成系统的企业而言,模型提供商承担一部分责任,但应用部署方仍需建立风险分级、数据治理

1989 280 0 25天前
OpenAI Assistants API将在8月26日关闭:迁移Responses API最后阶段完整清单

OpenAI Assistants API将在8月26日关闭:迁移Responses API最后阶段完整清单

OpenAI已经明确,Assistants API将在2026年8月26日停止服务。距离关闭日期不足一个月时,仍依赖Assistant、Thread、Run和Run Step对象的团队不能只把接口地址替换为Responses API。新架构使用Prompt或应用代码管理配置,以Conversation承载输入与输出Item,以Response取代Run,并要求应用更明确地管理工具循环、状态裁剪、重

1957 279 0 25天前
GPT-5.6 Luna降价80%、Terra降价20%:企业AI模型路由应该如何重算?

GPT-5.6 Luna降价80%、Terra降价20%:企业AI模型路由应该如何重算?

OpenAI在2026年7月30日更新GPT-5.6定价:Luna价格下调80%,Terra下调20%。在新的API价格下,Sol为每百万Token 5美元输入、30美元输出,Terra为2.5美元输入、15美元输出,Luna为1美元输入、6美元输出。降价并不意味着所有业务都应该立即切到Luna,而是需要重新计算“每个成功任务”的总成本,包括失败重试、人工复核、延迟、工具调用次数和缓存命中率。本文

1971 294 0 25天前
GPT-Live语音开始加入SynthID水印:企业语音Agent需要做哪些改造?

GPT-Live语音开始加入SynthID水印:企业语音Agent需要做哪些改造?

OpenAI在2026年7月31日更新GPT-Live:通过ChatGPT Voice和OpenAI API生成的受支持音频开始包含SynthID水印,公共验证工具可以检测OpenAI来源信号,同时新增验证API,供开发者和机构将来源检测接入自己的工作流。语音水印并不等于身份认证,也不能阻止所有剪辑、转码或欺诈,但它为企业语音Agent增加了可验证的内容来源信号。本文分析客服、外呼、数字人、媒体和

2081 302 0 25天前
OpenAI向10万名科研人员免费开放GPT-5.6:科研AI正在从工具试用进入体系化部署

OpenAI向10万名科研人员免费开放GPT-5.6:科研AI正在从工具试用进入体系化部署

OpenAI于2026年7月30日推出ChatGPT for Academic Researchers计划,计划到2027年向10万名科学家、数学家和工程师免费提供前沿模型与工具。今年夏季先覆盖1万名研究人员,参与者可使用GPT-5.6系列、Codex、Deep Research、更高使用额度和更大上下文窗口。这个计划的意义不只是“免费账号”,而是科研AI开始从个人零散使用转向机构工作区、数据治理

2180 295 0 26天前
GPT-5.6 API新增Programmatic Tool Calling与Multi-Agent:Agent架构会发生什么变化?

GPT-5.6 API新增Programmatic Tool Calling与Multi-Agent:Agent架构会发生什么变化?

GPT-5.6正式进入OpenAI API后,除了Sol、Terra、Luna三档模型,还新增两项值得开发者关注的Agent能力:Programmatic Tool Calling允许模型在内存中编写并运行程序,协调多个工具和处理中间结果;Multi-Agent Beta允许一个请求并发运行多个子Agent并汇总结果。这意味着复杂任务不再只能依赖“模型一次选择一个工具”的串行循环。本文分析这两项能

2137 284 0 26天前
Spring AI 2.0已经支持MCP 2026-07-28吗?Java项目升级兼容性分析

Spring AI 2.0已经支持MCP 2026-07-28吗?Java项目升级兼容性分析

MCP 2026-07-28规范已经正式发布,核心协议转向无状态,并增加请求路由头、列表缓存语义及扩展框架。与此同时,Spring AI 2.0文档已经提供STDIO、Streamable HTTP和STATELESS等MCP客户端与服务端配置。很多Java开发者因此认为,只要把`spring.ai.mcp.server.protocol`改成`STATELESS`,项目就已经完整支持新规范。实际

2278 321 0 27天前
长时间运行的AI Agent为什么不能只审核单次工具调用?轨迹级监控架构解析

长时间运行的AI Agent为什么不能只审核单次工具调用?轨迹级监控架构解析

传统Agent安全系统通常逐次检查工具调用:读取文件是否允许、网络请求是否合法、删除操作是否需要审批。但当模型可以连续工作数小时甚至数天时,每个单独动作都可能看起来合理,组合起来却在绕过限制、积累权限或追求用户并未批准的结果。OpenAI近期披露的长时模型内部部署经验表明,安全治理需要从单次动作判断升级到整条执行轨迹监控。本文分析长时Agent的新增风险,并给出轨迹状态、目标漂移检测、审批预算、干

2310 305 0 27天前
MCP 2026-07-28规范正式发布:无状态核心、扩展框架与生产迁移全解析

MCP 2026-07-28规范正式发布:无状态核心、扩展框架与生产迁移全解析

MCP官方已于2026年7月28日正式发布新一版规范,并同步推出可用于构建客户端和服务端的SDK。这是MCP自发布以来规模最大的一次协议修订:协议核心移除会话状态和初始化握手,更适合普通HTTP负载均衡;`Mcp-Method`与`Mcp-Name`让网关可以直接路由和限流;列表与资源读取增加明确缓存语义;MCP Apps和Tasks进入正式扩展体系;Roots、Sampling和Logging被

2240 304 0 28天前
OpenAI发布8个科学计算Agent案例:真正瓶颈正在从写代码转向验证代码

OpenAI发布8个科学计算Agent案例:真正瓶颈正在从写代码转向验证代码

OpenAI于2026年7月28日发布科学计算Agent实地报告,汇总8个主要来自生命科学领域的项目:其中5个使用Codex,3个结合Codex与Claude Code,覆盖软件维护、性能优化、语言迁移和GPU原生重构。案例显示,编程Agent显著降低了实现成本,但无法可靠判断结果是否在科学上正确,甚至可能在存在明显错误时仍表现自信。真正的瓶颈正在从“能否写出代码”转向“如何定义验收标准、验证数值

2549 345 2 28天前

精选推荐

1 ReAct、Plan-Execute-Review与状态图Agent怎么选? 1262 2 Agent Planner输出计划存在循环依赖?DAG校验与自动修复排查 1225 3 Human-in-the-Loop审批超时后任务丢失?等待状态与恢复令牌排查 1214 4 手搓生产级 AI Agent 系统(8):Planner、Executor与Reviewer闭环 1187 5 Reviewer为什么让Agent无限修改?接受阈值、最大轮次与差异检测排查 1166 6 Agent从Checkpoint恢复后为什么重复调用工具?步骤提交与副作用幂等排查 1131 7 用Python实现Planner-Executor-Reviewer状态机Agent 1078 8 手搓生产级 AI Agent 系统(9):Checkpoint、Human-in-the-Loop与断点恢复 1073 9 数据库Checkpoint、事件溯源与工作流引擎怎么选?Agent持久化指南 1070 10 用Spring Boot搭建Agent Checkpoint服务:保存、恢复、审批与重放 1066 11 并行Sub-Agent为什么让Token成本暴涨?并发、上下文复制与预算排查 1044 12 Supervisor、Handoff与Blackboard怎么选?多Agent协作模式指南 990 13 多Agent协作时为什么总是传递旧上下文?状态版本与消息边界排查 981 14 Code Interpreter临时文件为什么泄露到其他任务?工作目录与生命周期排查 978 15 手搓生产级 AI Agent 系统(10):多Agent协作、Supervisor与共享状态 971 16 手搓生产级 AI Agent 系统(11):代码与浏览器沙箱、安全执行与风险控制 965 17 Browser Agent遇到验证码和登录循环怎么办?会话、人工接管与站点策略排查 948 18 用Spring Boot实现预算感知的多Agent编排器 923 19 用Spring Boot搭建Agent安全执行网关:代码沙箱、浏览器会话与审计 912 20 容器沙箱、MicroVM与远程执行服务怎么选?Agent代码执行架构指南 894