智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
用Spring AI搭建证据包构建器:父子检索、压缩、Claim绑定与引用校验

用Spring AI搭建证据包构建器:父子检索、压缩、Claim绑定与引用校验

将检索候选转为带版本、来源、权限和稳定编号的证据包,并在生成后执行Claim校验。

1397 220 0 18天前
企业级RAG性能优化与质量治理(6):上下文压缩、证据绑定与可信引用

企业级RAG性能优化与质量治理(6):上下文压缩、证据绑定与可信引用

实现父子检索、抽取与生成压缩、关键条件保真、EvidenceID冻结和Claim校验。

1304 199 0 18天前
RAG查询改写后把关键实体改错了?人名、编号与否定词保护排查

RAG查询改写后把关键实体改错了?人名、编号与否定词保护排查

查询改写可能修改产品编号、人名、日期、否定条件和专业术语,导致检索方向错误。

1441 220 0 19天前
Multi-Query、HyDE与问题分解怎么选?RAG查询增强策略指南

Multi-Query、HyDE与问题分解怎么选?RAG查询增强策略指南

查询增强可以生成多个同义查询、构造假设答案或拆成子问题,本文比较适用场景。

1473 209 0 19天前
RAG查询改写后数字、缩写和型号消失?Token清洗排查

RAG查询改写后数字、缩写和型号消失?Token清洗排查

型号、错误码、版本和缩写是技术检索最重要的Token,清洗或改写阶段删除它们会同时损害稀疏和稠密检索。

1490 217 0 19天前
用Spring AI搭建RAG查询增强服务:实体保护、Multi-Query与结果融合

用Spring AI搭建RAG查询增强服务:实体保护、Multi-Query与结果融合

实现查询增强服务,对输入进行实体锁定、复杂度分类、策略选择、并行检索和结果融合。

1589 247 0 19天前
企业级RAG性能优化与质量治理(5):查询理解、改写与召回增强

企业级RAG性能优化与质量治理(5):查询理解、改写与召回增强

实现实体保护、指代消解、查询分类、Multi-Query、HyDE、问题分解和结果融合。

1276 204 0 19天前
Spring AI应用Docker健康检查正常,为什么真实模型调用全部失败?

Spring AI应用Docker健康检查正常,为什么真实模型调用全部失败?

进程健康只能证明容器存活,不代表凭证、网络、额度和指定模型可调用。

1577 217 0 20天前
滚动发布、蓝绿发布与金丝雀发布怎么选?AI应用上线策略指南

滚动发布、蓝绿发布与金丝雀发布怎么选?AI应用上线策略指南

AI应用的模型、Prompt、RAG索引和代码都会影响结果,本文比较三种发布策略。

1514 224 0 20天前
AI应用上线后Prompt版本混乱?配置漂移、缓存与多实例排查

AI应用上线后Prompt版本混乱?配置漂移、缓存与多实例排查

不同Pod使用不同Prompt缓存、配置中心版本或模型别名,会导致同一代码版本行为不一致。

1581 233 0 20天前
用GitHub Actions搭建Spring AI发布流水线:评测门禁、镜像、灰度与自动回滚

用GitHub Actions搭建Spring AI发布流水线:评测门禁、镜像、灰度与自动回滚

实现面向Spring AI应用的CI/CD流水线,在构建镜像前运行评测,发布后执行金丝雀检查。

1486 205 0 20天前
Spring AI企业级应用实战(14):容器化部署、灰度发布与配置治理

Spring AI企业级应用实战(14):容器化部署、灰度发布与配置治理

完成容器健康、Release Manifest、资产版本、金丝雀发布、质量观察和回滚。

1499 229 0 20天前
大模型单元测试为什么时好时坏?温度、模型漂移与断言方式排查

大模型单元测试为什么时好时坏?温度、模型漂移与断言方式排查

直接断言大模型完整字符串,会因采样、模型更新、提示词和检索变化产生脆弱测试。

1606 236 0 21天前
规则校验、LLM-as-a-Judge与人工评审怎么选?

规则校验、LLM-as-a-Judge与人工评审怎么选?

AI输出可以由规则、评审模型或人工专家评估,本文比较可重复性、覆盖范围、成本和偏差。

1703 265 0 21天前
黄金测试集更新后历史分数不能比较?数据集版本与基线漂移排查

黄金测试集更新后历史分数不能比较?数据集版本与基线漂移排查

不断补充样本后,新旧平均分不能直接比较,因为样本难度和分布已经变化。

1629 234 0 21天前
用JUnit搭建AI回归测试框架:数据集、规则评分、Judge与质量报告

用JUnit搭建AI回归测试框架:数据集、规则评分、Judge与质量报告

实现可在CI运行的AI回归框架,读取JSONL数据集,执行规则与Judge评分并比较基线。

1886 262 0 21天前
Spring AI企业级应用实战(13):测试、黄金数据集与发布质量门禁

Spring AI企业级应用实战(13):测试、黄金数据集与发布质量门禁

建立单元测试、Provider契约、黄金数据集、规则评分、Judge和CI质量门禁。

1704 238 0 21天前
Spring WebFlux请求超时后AI任务为什么还在运行?

Spring WebFlux请求超时后AI任务为什么还在运行?

前端或网关超时只终止HTTP响应,不一定向上游模型、工具或队列传播取消信号。

1702 234 0 22天前
同步接口、消息队列与工作流引擎怎么选?AI长任务架构指南

同步接口、消息队列与工作流引擎怎么选?AI长任务架构指南

AI报告、代码扫描和批量入库可能持续数分钟甚至数小时,本文比较同步HTTP、消息队列和工作流引擎。

1587 227 0 22天前
AI异步回调为什么会重复到达?至少一次投递与幂等排查

AI异步回调为什么会重复到达?至少一次投递与幂等排查

网络超时、消费者重启和ACK丢失会让同一回调多次到达,必须按至少一次投递设计。

1677 246 0 22天前
上一页 1 2 3 ... 5 6 7 ... 16 17 18 下一页

精选推荐

1 ReAct、Plan-Execute-Review与状态图Agent怎么选? 1262 2 Agent Planner输出计划存在循环依赖?DAG校验与自动修复排查 1225 3 Human-in-the-Loop审批超时后任务丢失?等待状态与恢复令牌排查 1214 4 手搓生产级 AI Agent 系统(8):Planner、Executor与Reviewer闭环 1187 5 Reviewer为什么让Agent无限修改?接受阈值、最大轮次与差异检测排查 1166 6 Agent从Checkpoint恢复后为什么重复调用工具?步骤提交与副作用幂等排查 1131 7 用Python实现Planner-Executor-Reviewer状态机Agent 1081 8 手搓生产级 AI Agent 系统(9):Checkpoint、Human-in-the-Loop与断点恢复 1073 9 数据库Checkpoint、事件溯源与工作流引擎怎么选?Agent持久化指南 1070 10 用Spring Boot搭建Agent Checkpoint服务:保存、恢复、审批与重放 1066 11 并行Sub-Agent为什么让Token成本暴涨?并发、上下文复制与预算排查 1044 12 Supervisor、Handoff与Blackboard怎么选?多Agent协作模式指南 990 13 多Agent协作时为什么总是传递旧上下文?状态版本与消息边界排查 981 14 Code Interpreter临时文件为什么泄露到其他任务?工作目录与生命周期排查 978 15 手搓生产级 AI Agent 系统(10):多Agent协作、Supervisor与共享状态 971 16 手搓生产级 AI Agent 系统(11):代码与浏览器沙箱、安全执行与风险控制 965 17 Browser Agent遇到验证码和登录循环怎么办?会话、人工接管与站点策略排查 949 18 用Spring Boot实现预算感知的多Agent编排器 923 19 用Spring Boot搭建Agent安全执行网关:代码沙箱、浏览器会话与审计 913 20 容器沙箱、MicroVM与远程执行服务怎么选?Agent代码执行架构指南 894