12 种 RAG(检索增强生成)的新型高级架构与方法,建议收藏!

RAG(检索增强生成)曾是极其热门的话题之一。而本周非常幸运地看到了一些关于 RAG 的真正令人兴奋的新研究

让我们一起来看看近期出现的12 种 RAG 高级架构与方法

1. Mindscape-Aware RAG (MiA-RAG)

全局感知 RAG

MiA-RAG 通过首先构建整个文本的高层摘要(即“全局视图”),帮助 RAG 系统处理长文档。这个全局视图随后被用来指导系统检索什么内容以及如何回答,帮助模型将分散的证据连接起来,像人类阅读长文档一样进行推理。

论文标题:Mindscape-Aware Retrieval Augmented Generation for Improved Long Context Understanding

论文链接:https://arxiv.org/abs/2512.17220

感觉这个idea不错,之前看到过很多内容压缩的工作,这个工作是把全文摘要除了加到Context,也加到了Query里面,这样子有利于检索全文感知的Chunk

2. Multi-step RAG with Hypergraph-based Memory (HGMem)

基于超图记忆的多步 RAG

HGMem 是一种增强多步 RAG 的新记忆设计。它将检索到的信息组织成超图(Hypergraph),允许事实随着时间的推移相互连接和组合。这有助于模型构建结构化知识,进行更连贯的推理,并更好地理解复杂的上下文。

论文标题:Improving Multi-step RAG with Hypergraph-based Memory for Long-Context Complex Relational Modeling

论文链接:https://arxiv.org/abs/2512.23959

代码链接:https://github.com/Encyclomen/HGMem

这个看起来有点复杂,大家细读论文吧

3. QuCo-RAG

基于共现统计的动态 RAGQuCo-RAG 是一种动态 RAG 方法,它根据模型预训练数据的统计信息(而非模型自信度)来决定何时检索信息。它会标记罕见或可疑的实体,并检查它们是否在真实数据中共现(Co-occur),从而触发检索以减少幻觉并提高事实准确性。

论文标题:QuCo-RAG: Quantifying Uncertainty from the Pre-training Corpus for Dynamic Retrieval-Augmented Generation

论文链接:https://arxiv.org/pdf/2512.19134

代码链接:https://github.com/ZhishanQ/QuCo-RAG

这个想法很好,我们经常会面临一个情况是如果大模型已经学了相关查询对应的知识,我们还需要检索吗?这个工作应该一般部分回答了如何解决这个问题。

不过心里有个疑问?“根据模型预训练数据的统计信息(而非模型自信度)来决定何时检索信息”,如果每次都需要统计一个比较大的预训练预料,效率是不是很慢

4. HiFi-RAG

高保真分层 RAG

HiFi-RAG 是一个分层的 RAG 管道,在生成之前分多个阶段过滤检索到的文档。它利用Gemini 2.5 Flash来重构查询、修剪不相关的段落并附加引用,然后仅依靠Gemini 2.5 Pro进行最终的答案生成。

论文标题:HiFi-RAG: Hierarchical Content Filtering and Two-Pass Generation for Open-Domain RAG

论文链接:https://arxiv.org/pdf/2512.22442

5. Bidirectional RAG

双向 RAG该方法允许对检索语料库进行受控的“回写”(Write-back)。生成的答案只有通过接地性检查(Grounding checks,包括基于 NLI 的蕴含关系、来源归因验证和新颖性检测)后,才会被添加到知识库中。这使得系统能够在使用过程中扩展其知识库,而不会被幻觉污染。

论文标题:Bidirectional RAG: Safe Self-Improving Retrieval-Augmented Generation Through Multi-Stage Validation

论文链接:https://arxiv.org/pdf/2512.22199

6. TV-RAG

长视频时序 RAG

TV-RAG 是一个针对长视频的免训练(Training-free)RAG 框架,它为检索增加了时间感知能力。它利用时间偏移量对检索到的文本进行排序,并使用基于熵的采样来选择关键视频帧,帮助视频语言模型对齐视觉、音频和字幕信息,并在长视频时间轴上进行更准确的推理。

论文标题:TV-RAG: A Temporal-aware and Semantic Entropy-Weighted Framework for Long Video Retrieval and Understanding

论文链接:https://arxiv.org/pdf/2512.23483

7. MegaRAG

巨型多模态 RAG

MegaRAG 专为书籍等长文档构建,围绕多模态知识图谱设计。它从文本和视觉内容中提取实体和关系,构建分层图谱,并在检索和生成过程中使用它。这有助于模型进行全局推理,更准确地回答文本和视觉问题。

论文标题:MegaRAG: Multimodal Knowledge Graph-Based Retrieval Augmented Generation

论文链接:https://arxiv.org/pdf/2512.20626

8. AffordanceRAG

可供性感知 RAG这是专为移动机器人设计的零样本(Zero-shot)、多模态 RAG 系统。它通过探索环境的图像构建“可供性感知记忆”(Affordance-aware memory),利用视觉和区域特征检索物体和位置,并根据可供性得分对它们进行重排序,从而选择机器人能够在物理上执行的动作,改善现实世界中的操作能力。

论文标题:Affordance RAG: Hierarchical Multimodal Retrieval with Affordance-Aware Embodied Memory for Mobile Manipulation

论文链接:https://arxiv.org/pdf/2512.18987

9. Graph-O1

基于图的 O1 推理

Graph-O1 是一个针对文本属性图问答的代理式(Agent-based)GraphRAG 系统。它不像传统方法那样一次性读取整个图,而是使用蒙特卡洛树搜索(MCTS)和强化学习(RL)逐步探索最相关的节点和边,从而在 LLM 上下文限制内实现高效、结构化的推理。

论文标题:Graph-O1 : Monte Carlo Tree Search with Reinforcement Learning for Text-Attributed Graph Reasoning

论文链接:https://arxiv.org/pdf/2512.17912

10. SignRAG

路标识别 RAG

SignRAG 是建立在 RAG 之上的零样本交通标志识别系统。它使用视觉-语言模型来描述标志图像,从向量数据库中检索相似的标志设计,然后让 LLM 对候选标志进行推理以识别正确的标志,无需进行特定任务的训练。

论文标题:SignRAG: A Retrieval-Augmented System for Scalable Zero-Shot Road Sign Recognition

论文链接:https://arxiv.org/pdf/2512.12885

这个研究工作是在一个交通信号领域的多模态RAG,做法是比较常规的,图片的描述生成,然后索引构建,在检索的时候召回拼接到上下文去做回答

11. Hybrid RAG for Multilingual Document QA

多语言文档问答混合 RAG

这是一个针对充满噪声的历史报纸问答的多语言 RAG 系统。它通过语义查询扩展、使用倒数排名融合(Reciprocal Rank Fusion)的多查询检索,以及仅在存在证据时才回答的生成提示词,来处理 OCR 错误和语言演变问题。

论文标题:Hybrid Retrieval-Augmented Generation for Robust Multilingual Document Question Answering

论文链接:https://arxiv.org/pdf/2512.12694

代码链接:https://anonymous.4open.science/r/RAGs-C5AE/

12. RAGPart and RAGMask

RAG 安全防御机制

这是针对 RAG 语料库投毒攻击的轻量级防御措施。RAGPart利用密集检索器如何从分区数据中学习的特性,限制恶意文档的影响;而RAGMask则通过掩盖 Token 和检测异常的相似度偏移来标记可疑文档,且无需修改生成模型本身。

如何学习AI大模型?

如果你对AI大模型入门感兴趣,那么你需要的话可以点击这里大模型重磅福利:入门进阶全套104G学习资源包免费分享!

这份完整版的大模型 AI 学习和面试资料已经上传CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】

这是一份大模型从零基础到进阶的学习路线大纲全览,小伙伴们记得点个收藏!


第一阶段:从大模型系统设计入手,讲解大模型的主要方法;

第二阶段:在通过大模型提示词工程从Prompts角度入手更好发挥模型的作用;

第三阶段:大模型平台应用开发借助阿里云PAI平台构建电商领域虚拟试衣系统;

第四阶段:大模型知识库应用开发以LangChain框架为例,构建物流行业咨询智能问答系统;

第五阶段:大模型微调开发借助以大健康、新零售、新媒体领域构建适合当前领域大模型;

第六阶段:以SD多模态大模型为主,搭建了文生图小程序案例;

第七阶段:以大模型平台应用与开发为主,通过星火大模型,文心大模型等成熟大模型构建大模型行业应用。

100套AI大模型商业化落地方案

大模型全套视频教程

200本大模型PDF书籍

👉学会后的收获:👈

• 基于大模型全栈工程实现(前端、后端、产品经理、设计、数据分析等),通过这门课可获得不同能力;

• 能够利用大模型解决相关实际项目需求: 大数据时代,越来越多的企业和机构需要处理海量数据,利用大模型技术可以更好地处理这些数据,提高数据分析和决策的准确性。因此,掌握大模型应用开发技能,可以让程序员更好地应对实际项目需求;

• 基于大模型和企业数据AI应用开发,实现大模型理论、掌握GPU算力、硬件、LangChain开发框架和项目实战技能, 学会Fine-tuning垂直训练大模型(数据准备、数据蒸馏、大模型部署)一站式掌握;

• 能够完成时下热门大模型垂直领域模型训练能力,提高程序员的编码能力: 大模型应用开发需要掌握机器学习算法、深度学习框架等技术,这些技术的掌握可以提高程序员的编码能力和分析能力,让程序员更加熟练地编写高质量的代码。

LLM面试题合集

大模型产品经理资源合集

大模型项目实战合集

👉获取方式:
😝有需要的小伙伴,可以保存图片到wx扫描二v码免费领取【保证100%免费】🆓

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.mzph.cn/news/1125467.shtml

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

java学习进阶之路,如果从一个菜鸟进阶成大神

二、下面是java工作之路,以供参考: 三、下面给出阶段性细化需要掌握的技能:1.第一阶段2.第二阶段3.第三阶段4.第四阶段5.第五阶段四、更加细化的细节如下:1: 编程基础 不管是C还是C,不管是Java还是PHP&…

Java_ElasticSearch(ES)——分布式搜索引擎

介绍: Elasticsearch是一个开源的分布式搜索和分析引擎,最初由Elastic公司开发。它构建在Apache Lucene搜索引擎库之上,提供了一个强大的全文搜索和分析引擎,它结合kibana、Logstash、Beats,是一整套技术栈&#xff0…

手写一个单例模式 (考虑线程安全)。

手写一个单例模式 (考虑线程安全) 关键词:单例模式, 线程安全, 设计模式, 双重检查锁定, 并发编程, 懒汉式, 饿汉式 摘要:单例模式是软件开发中最基础也最常用的设计模式之一,它保证一个类在整个系统中只有一个实例,并提供全局访问点。然而在多线程环境下,简单的单例实现可…

一个在使用方法上的低级错误(MySQL场景)

首先申明这个技术含量不高初始化问题数据。注意这里的t代表时间,数据类型是字符串。为什么用字符串来表示时间?那这就是问题所在。当初创建的人不懂。这个回答不知道满意吗?mysql> create table t1 (id int,t varchar(20)); Query OK, 0 r…

深度学习毕设选题推荐:基于python的CNN训练识别吃的美食基于深度学习的CNN训练识别吃的美食

博主介绍:✌️码农一枚 ,专注于大学生项目实战开发、讲解和毕业🚢文撰写修改等。全栈领域优质创作者,博客之星、掘金/华为云/阿里云/InfoQ等平台优质作者、专注于Java、小程序技术领域和毕业项目实战 ✌️技术范围:&am…

深度学习毕设项目推荐-深度学习基于python的CNN训练识别吃的美食基于python的深度学习CNN训练识别吃的美食

博主介绍:✌️码农一枚 ,专注于大学生项目实战开发、讲解和毕业🚢文撰写修改等。全栈领域优质创作者,博客之星、掘金/华为云/阿里云/InfoQ等平台优质作者、专注于Java、小程序技术领域和毕业项目实战 ✌️技术范围:&am…

救命神器!9个AI论文网站测评:本科生毕业论文全攻略

救命神器!9个AI论文网站测评:本科生毕业论文全攻略 学术写作新选择:AI论文网站测评全解析 在当前高校教育日益重视科研能力的背景下,本科生在撰写毕业论文时面临诸多挑战,如选题困难、资料查找繁琐、格式规范不熟悉等。…

ReadView的结构和工作原理?

你想深入掌握 Read View 的结构和工作原理,这是理解 MVCC 快照读的核心 ——Read View 就像 MVCC 的 “版本安检员”,决定了当前事务能看到版本链中的哪个版本。接下来我会先拆解 Read View 的核心结构,再用通俗的逻辑 实例讲清它的工作原理…

Java 进阶:如何让线程主动让出 CPU

Java 进阶如何让线程主动让出 CPU ThreadsleepThreadyieldThreadcurrentThreadsuspendObjectwaitLockSupportparkThreadstop Java 进阶:如何让线程主动让出 CPU Thread.sleep sleep 方法可以让线程主动让出 CPU,但是并不会释放锁。 /*** Causes the …

AngularJS 模块详解

AngularJS 模块详解 引言 AngularJS 是一个强大的JavaScript框架,用于构建单页应用程序(SPA)。它提供了一套丰富的特性,其中包括模块化。模块化是现代软件开发的一个重要概念,它有助于提高代码的可维护性和可扩展性。本文将详细解析 AngularJS 模块的概念、创建和使用方…

救命神器!自考必看TOP9 AI论文网站测评与推荐

救命神器!自考必看TOP9 AI论文网站测评与推荐 2026年自考论文写作工具测评:为何需要这份榜单? 随着人工智能技术的不断进步,AI论文写作工具在学术领域的应用越来越广泛。对于自考学生而言,撰写高质量论文不仅是毕业的必…

idea创建springBoot的五种方式

目录 第一种 第二种 第三种 第四种 第五种 1.先创建一个普通的mavenjava项目 2.pom.xml 3.启动类 4.controller 5.运行访问 第一种 idea直接从spring.io官网下载 https://start.spring.io/ 使用jar包创建就行,也是maven项目,jdk选1.8&#…

Java实战:Spring Boot application.yml配置文件详解

本文将详细介绍Spring Boot application.yml 配置文件的使用和配置项。我们将探讨 application.yml 文件的基本概念,以及如何使用它来配置Spring Boot应用程序的各个方面。此外,我们将通过具体的示例来展示如何配置不同的Spring Boot组件,如数…

idea、mybatis报错Property ‘sqlSessionFactory‘ or ‘sqlSessionTemplate‘ are required

这个错误通常与MyBatis的配置有关,涉及到MyBatis的SqlSessionFactory或SqlSessionTemplate的配置问题。以下是一些可能的解决方案: 1.检查DataSource配置: 确保你的数据源(DataSource)被正确配置。在Spring Boot中&…

Azure GPv1 存储账户迁移至 GPv2 完整指南

概述 Microsoft Azure 将于 2026年10月13日 正式退役通用用途 v1(General-purpose v1,GPv1)存储账户。所有用户必须在此日期前将 GPv1 存储账户升级至通用用途 v2(General-purpose v2,GPv2),以避免服务中断和潜在的成本增加。 为什么需要迁移? 退役时间线 截止日期:…

Java学习进阶知识篇

系列文章目录 提示:....................... 文章目录 系列文章目录前言一、类和对象 面向对象基本介绍类的基本使用属性构造方法和析构方法对象 二、总结 前言 提示:这里可以添加本文要记录的大概内容: Java面向对象编程的进阶知识 一、…

Prompt Tuning动态选医疗特征提速诊断

📝 博客主页:Jax的CSDN主页 Prompt Tuning动态选医疗特征提速诊断 目录Prompt Tuning动态选医疗特征提速诊断 引言:诊断效率的全球性挑战 技术原理:动态特征选择的机制创新 现实应用:2023年临床试点的突破性验证 挑战与…

Memcached 连接:深入理解与优化实践

Memcached 连接:深入理解与优化实践 引言 Memcached 是一种高性能的分布式内存对象缓存系统,它能够存储键值对,广泛应用于减轻数据库负载、提高系统响应速度等方面。在Memcached的应用中,连接的建立和维护是至关重要的。本文将深入探讨Memcached连接的原理、优化策略以及…

深度学习计算机毕设之基于python训练鲜花识别基于卷神经网络训练鲜花识别

博主介绍:✌️码农一枚 ,专注于大学生项目实战开发、讲解和毕业🚢文撰写修改等。全栈领域优质创作者,博客之星、掘金/华为云/阿里云/InfoQ等平台优质作者、专注于Java、小程序技术领域和毕业项目实战 ✌️技术范围:&am…

HeidiSQL导入与导出数据

HeidiSQL两种导入与导出数据的方法:整个库复制,和仅复制数据 一 整个库复制 1 选中需要导出的数据库(这里是MyDBdata),点击导出为SQL脚本。2 按照如图进行选择3 选做:删除当前数据库【如果有】 -- 删除数据库 USE mysql; DROP DAT…