跳到主内容
智客 ZICQ

智客专题 RAG 实战专题

RAG 实战专题

检索增强生成(RAG)从原理到工程实践:分块策略、向量检索、重排序、混合检索与生产级评估。

· 2026年8月20日 #RAG#检索增强#向量检索#技术深度 · 30 / 149 篇内容

智客前沿 · 2026-09-30

ArXiv提出TVS方法:检测RAG系统中的知识冲突与语义分歧

ArXiv发布了一项关于检索增强生成(RAG)系统的新研究,提出了一种名为Trajectory Variance Score(TVS)的新方法,用于检测RAG系统中由于检索上下文与参数知识冲突而导致的语义分歧问题。TVS通过计算独立随机去噪…

智客前沿 · 2026-09-30

ArXiv发布RAG系统研究:解析印度政府法规文档的检索增强生成技术

ArXiv发布了一项关于检索增强生成(RAG)系统的研究,重点探讨了文档解析、分块策略和嵌入模型对RAG系统性能的影响。研究通过控制性实验评估了3种解析器、3种分块策略和5种密集嵌入模型,并结合稀疏BM25基线模型,对800个问题实例进行了…

智客信息 · 2026-09-29

Qwen3.5-4B微调:优化RAG管道以替代Gemini Flash-Lite

本文探讨了如何通过微调Qwen3.5-4B模型来优化检索增强生成(RAG)管道,并探讨其替代Gemini Flash-Lite的可行性。Qwen3.5-4B作为一款开源大语言模型,在本地部署和资源优化方面具有显著优势。通过对模型的微调,研究…

智客信息 · 2026-09-25

Apowerb开源AI智能体运行时:支持RAG、Text-to-SQL和Webhook

Apowerb是一款开源的AI智能体运行时平台,专注于支持检索增强生成(RAG)、文本转SQL(Text-to-SQL)和Webhook等关键功能。该平台旨在为开发者提供灵活且可扩展的AI智能体构建工具,简化复杂任务的自动化流程。Apowe…

智客信息 · 2026-09-22

AI·rete·RAG发布:Rete引擎与RAG结合实现可审计决策与解释

AI·rete·RAG是一款新型决策支持系统,旨在解决AI模型在关键领域(如贷款审批、欺诈检测、医疗分诊)中决策不可审计的问题。该系统采用Rete规则引擎与检索增强生成(RAG)技术相结合的方式,首先通过纯Python的Rete引擎基于YA…

智客前沿 · 2026-09-22

AdaMem框架发布:提升RAG系统效率的软压缩新方法

AdaMem是一种基于相关性指导的软压缩框架,旨在优化检索增强生成(RAG)系统中的内存分配策略。该方法通过学习到的段落相关性估计,动态分配固定内存token预算,从而提高生成质量并降低推理延迟。在多个开放域问答基准测试中,AdaMem在标…

智客前沿 · 2026-09-16

NepKANUN发布:基于RAG的尼泊尔法律AI助手助力法律知识普及

NepKANUN是一款基于检索增强生成(RAG)框架的尼泊尔法律AI助手,旨在解决尼泊尔法律信息获取困难的问题。该助手通过微调的大型语言模型和高质量的问答数据集进行训练,在处理复杂法律术语和提供精准答案方面表现出色。根据BERTScore评…

智客信息 · 2026-09-15

Make0 AI发布Brain:跨智能体共享记忆系统,革新AI交互体验

Make0 AI推出了一款名为Brain的跨智能体共享记忆系统,旨在解决AI智能体在多任务处理中重复初始化上下文的问题。该系统通过RAG检索技术和图结构存储,实现了高效、灵活的记忆管理,支持AI智能体之间的长期记忆共享和交互。Brain不仅…

智客前沿 · 2026-09-13

LlamaIndex 发布 RAG 系统指南:应对 ChatGPT 知识更新滞后问题

LlamaIndex 近日发布了一篇关于检索增强生成 (RAG) 系统的详细指南,旨在解决 ChatGPT 等大语言模型的知识更新滞后问题。该指南介绍了 RAG 的核心概念,即通过搜索相关数据并将其提供给 LLM 来提升生成结果的准确性和时…

智客前沿 · 2026-09-13

LlamaIndex 发布嵌入模型微调指南:利用合成数据优化 RAG 系统性能

LlamaIndex 推出了一款基于合成数据的嵌入模型微调指南,旨在提升 RAG(检索增强生成)系统的检索性能。通过自动生成训练样本,无需人工标注,即可实现 5%-10% 的检索性能提升。该方法通过优化嵌入空间,使模型更好地理解特定领域的数…

智客前沿 · 2026-09-13

LlamaIndex 发布线性适配器微调引擎:优化 RAG 检索性能

LlamaIndex 推出了一款名为 EmbeddingAdapterFinetuneEngine 的新工具,用于对任何嵌入模型生成的查询嵌入进行线性适配器微调,从而优化 RAG(检索增强生成)系统的检索性能。该工具无需重新嵌入文档,仅需对…

智客前沿 · 2026-09-13

LlamaIndex 发布 RAG 系统最佳分块大小评估指南

LlamaIndex 推出了一篇关于 RAG(检索增强生成)系统分块大小优化的详细指南,旨在帮助开发者通过评估不同分块尺寸对系统准确性和响应时间的影响,找到最佳配置。该指南结合了 Faithfulness 和 Relevancy 指标,并提…