用Spring AI搭建证据包构建器:父子检索、压缩、Claim绑定与引用校验
将检索候选转为带版本、来源、权限和稳定编号的证据包,并在生成后执行Claim校验。
企业级RAG性能优化与质量治理(6):上下文压缩、证据绑定与可信引用
实现父子检索、抽取与生成压缩、关键条件保真、EvidenceID冻结和Claim校验。
RAG查询改写后把关键实体改错了?人名、编号与否定词保护排查
查询改写可能修改产品编号、人名、日期、否定条件和专业术语,导致检索方向错误。
Multi-Query、HyDE与问题分解怎么选?RAG查询增强策略指南
查询增强可以生成多个同义查询、构造假设答案或拆成子问题,本文比较适用场景。
RAG查询改写后数字、缩写和型号消失?Token清洗排查
型号、错误码、版本和缩写是技术检索最重要的Token,清洗或改写阶段删除它们会同时损害稀疏和稠密检索。
用Spring AI搭建RAG查询增强服务:实体保护、Multi-Query与结果融合
实现查询增强服务,对输入进行实体锁定、复杂度分类、策略选择、并行检索和结果融合。
企业级RAG性能优化与质量治理(5):查询理解、改写与召回增强
实现实体保护、指代消解、查询分类、Multi-Query、HyDE、问题分解和结果融合。
Spring AI应用Docker健康检查正常,为什么真实模型调用全部失败?
进程健康只能证明容器存活,不代表凭证、网络、额度和指定模型可调用。
滚动发布、蓝绿发布与金丝雀发布怎么选?AI应用上线策略指南
AI应用的模型、Prompt、RAG索引和代码都会影响结果,本文比较三种发布策略。
AI应用上线后Prompt版本混乱?配置漂移、缓存与多实例排查
不同Pod使用不同Prompt缓存、配置中心版本或模型别名,会导致同一代码版本行为不一致。
用GitHub Actions搭建Spring AI发布流水线:评测门禁、镜像、灰度与自动回滚
实现面向Spring AI应用的CI/CD流水线,在构建镜像前运行评测,发布后执行金丝雀检查。
Spring AI企业级应用实战(14):容器化部署、灰度发布与配置治理
完成容器健康、Release Manifest、资产版本、金丝雀发布、质量观察和回滚。
大模型单元测试为什么时好时坏?温度、模型漂移与断言方式排查
直接断言大模型完整字符串,会因采样、模型更新、提示词和检索变化产生脆弱测试。
规则校验、LLM-as-a-Judge与人工评审怎么选?
AI输出可以由规则、评审模型或人工专家评估,本文比较可重复性、覆盖范围、成本和偏差。
黄金测试集更新后历史分数不能比较?数据集版本与基线漂移排查
不断补充样本后,新旧平均分不能直接比较,因为样本难度和分布已经变化。
用JUnit搭建AI回归测试框架:数据集、规则评分、Judge与质量报告
实现可在CI运行的AI回归框架,读取JSONL数据集,执行规则与Judge评分并比较基线。
Spring AI企业级应用实战(13):测试、黄金数据集与发布质量门禁
建立单元测试、Provider契约、黄金数据集、规则评分、Judge和CI质量门禁。
Spring WebFlux请求超时后AI任务为什么还在运行?
前端或网关超时只终止HTTP响应,不一定向上游模型、工具或队列传播取消信号。
同步接口、消息队列与工作流引擎怎么选?AI长任务架构指南
AI报告、代码扫描和批量入库可能持续数分钟甚至数小时,本文比较同步HTTP、消息队列和工作流引擎。
AI异步回调为什么会重复到达?至少一次投递与幂等排查
网络超时、消费者重启和ACK丢失会让同一回调多次到达,必须按至少一次投递设计。