智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
Box 开始把表格、图表和整页 PDF 直接塞进同一个向量空间:传统 RAG 的“先转纯文本”正在过时

Box 开始把表格、图表和整页 PDF 直接塞进同一个向量空间:传统 RAG 的“先转纯文本”正在过时

昨天 Google Cloud 和 Box 公布了 Gemini Multimodal Embeddings 2 在 Box Agentic Platform 里的一个企业级落地方向。

510 89 0 7天前
企业级RAG性能优化与质量治理(7):GraphRAG、Agentic RAG与多跳检索

企业级RAG性能优化与质量治理(7):GraphRAG、Agentic RAG与多跳检索

实现查询复杂度识别、图关系检索、多步骤计划、证据状态和终止条件。

1267 198 0 17天前
企业级RAG性能优化与质量治理(6):上下文压缩、证据绑定与可信引用

企业级RAG性能优化与质量治理(6):上下文压缩、证据绑定与可信引用

实现父子检索、抽取与生成压缩、关键条件保真、EvidenceID冻结和Claim校验。

1304 199 0 18天前
企业级RAG性能优化与质量治理(5):查询理解、改写与召回增强

企业级RAG性能优化与质量治理(5):查询理解、改写与召回增强

实现实体保护、指代消解、查询分类、Multi-Query、HyDE、问题分解和结果融合。

1276 204 0 19天前
企业级RAG性能优化与质量治理(4):增量更新、版本治理、引用溯源与线上监控

企业级RAG性能优化与质量治理(4):增量更新、版本治理、引用溯源与线上监控

# 企业级RAG性能优化与质量治理(4):增量更新、版本治理、引用溯源与线上监控 ## 文章摘要 企业RAG进入长期运行阶段后,真正困难的工作从“把文档放进向量库”转向知识生命周期治理:如何只更新变化内容、如何确保新旧版本不会同时生效、如何让每个答案追溯到具体文档与Chunk、如何发现线上召回过期内容,以及如何在更新失败时安全回滚。本文从数据模型、版本状态机、增量索引、删除传播、引用链路、缓存

2409 369 2 2026-07-24
企业级RAG性能优化与质量治理(2):文档解析与Chunk工程决定知识库上限

企业级RAG性能优化与质量治理(2):文档解析与Chunk工程决定知识库上限

# 企业级RAG性能优化与质量治理(2):文档解析与Chunk工程决定知识库上限 ## 文章摘要 很多团队把RAG效果差归因于Embedding模型、向量数据库或大模型,却忽略了最前面的文档解析与Chunk工程。PDF乱码、表格丢失、标题层级消失、旧版本混入和固定长度粗暴切分,会在数据进入向量库前就破坏知识。本文建立一套生产级文档管道:文件识别、结构解析、清洗、质量门禁、结构分块、父子Chun

2370 393 3 2026-07-23
企业级RAG性能优化与质量治理(3):混合检索、重排与权限过滤的生产级设计

企业级RAG性能优化与质量治理(3):混合检索、重排与权限过滤的生产级设计

# 企业级RAG性能优化与质量治理(3):混合检索、重排与权限过滤的生产级设计 ## 文章摘要 前两篇分别讨论了RAG质量问题的总体诊断,以及文档解析与Chunk工程。本篇进入检索核心:为什么企业知识库不能只依赖单一向量召回,Dense、Sparse、Metadata过滤、融合、重排和权限控制应如何组合,以及怎样通过黄金测试集和线上指标持续治理召回质量。本文给出一套可落地的生产级检索架构、数据

2247 353 1 2026-07-23
招投标文档接入RAG应该如何分块?评分项、参数表和附件不能用同一种策略

招投标文档接入RAG应该如何分块?评分项、参数表和附件不能用同一种策略

招标文件通常同时包含资格条件、技术参数、评分办法、商务条款、合同模板和附件表格。如果简单按固定字数切分,容易把评分条件拆散、把表格表头与数据分离,并导致模型找到了条款却无法判断完整约束。本文给出一套适用于招投标知识库的层级分块方案,包括文档结构识别、章节父子块、评分项原子块、参数表重建、元数据设计和混合检索流程。

2535 360 3 2026-07-19
RAG 系统深度实战:从朴素检索到 Agentic RAG 的完整演进

RAG 系统深度实战:从朴素检索到 Agentic RAG 的完整演进

万字拆解 RAG 完整技术演进路线。五种分块策略实测、六款 Embedding 模型 Benchmark、三种检索优化、Self-RAG/Corrective RAG/Agentic RAG 进阶模式。附可运行项目。

2681 379 1 2026-07-05
小白也能懂的 RAG 原理 —— 从检索到生成的完整指南

小白也能懂的 RAG 原理 —— 从检索到生成的完整指南

本文用通俗的语言和实例,带你理解 RAG(检索增强生成)的核心原理、主流架构和落地实践,适合 AI 初学者和想要快速了解 RAG 的开发者。

3266 429 3 2026-05-29

精选推荐

1 ReAct、Plan-Execute-Review与状态图Agent怎么选? 1262 2 Agent Planner输出计划存在循环依赖?DAG校验与自动修复排查 1225 3 Human-in-the-Loop审批超时后任务丢失?等待状态与恢复令牌排查 1214 4 手搓生产级 AI Agent 系统(8):Planner、Executor与Reviewer闭环 1187 5 Reviewer为什么让Agent无限修改?接受阈值、最大轮次与差异检测排查 1166 6 Agent从Checkpoint恢复后为什么重复调用工具?步骤提交与副作用幂等排查 1131 7 用Python实现Planner-Executor-Reviewer状态机Agent 1078 8 手搓生产级 AI Agent 系统(9):Checkpoint、Human-in-the-Loop与断点恢复 1073 9 数据库Checkpoint、事件溯源与工作流引擎怎么选?Agent持久化指南 1070 10 用Spring Boot搭建Agent Checkpoint服务:保存、恢复、审批与重放 1066 11 并行Sub-Agent为什么让Token成本暴涨?并发、上下文复制与预算排查 1044 12 Supervisor、Handoff与Blackboard怎么选?多Agent协作模式指南 990 13 多Agent协作时为什么总是传递旧上下文?状态版本与消息边界排查 981 14 Code Interpreter临时文件为什么泄露到其他任务?工作目录与生命周期排查 978 15 手搓生产级 AI Agent 系统(10):多Agent协作、Supervisor与共享状态 971 16 手搓生产级 AI Agent 系统(11):代码与浏览器沙箱、安全执行与风险控制 965 17 Browser Agent遇到验证码和登录循环怎么办?会话、人工接管与站点策略排查 948 18 用Spring Boot实现预算感知的多Agent编排器 923 19 用Spring Boot搭建Agent安全执行网关:代码沙箱、浏览器会话与审计 912 20 容器沙箱、MicroVM与远程执行服务怎么选?Agent代码执行架构指南 894