检索增强 RAG
阅读 4
评论 0
点赞 0
RAG 检索增强生成
RAG技术通过将外部知识库与LLM结合,有效缓解模型幻觉。其核心流程分为数据准备(采集、解析、智能分块、向量化)和查询响应(查询理解、混合检索、重排序、上下文构建、生成)。优化方向包括前检索(查询重写、多查询扩展)、中检索(混合检索、多路召回)和后检索(重排序、上下文压缩、拒答兜底)。分块策略推荐500字符/100重叠的滑动窗口,平衡语义完整与检索效率。表格和图片需经OCR或结构化处理后嵌入。混合检索融合向量语义与BM25关键词,RRF或加权归一化可融合排序。Rerank用Cross-Encoder模型精排候选结果。评估采用RAGAS框架的忠实度、答案相关性等指标。进阶范式中GraphRAG支持多跳推理,Self-RAG实现自主决策。工程落地需关注数据治理、检索加速(HNSW索引)和时效性管理。掌握RAG需从流程、优化到量化评估迭代,适配业务场景。