Interleaving Retrieval with Chain-of-Thought Reasoning for Knowledge-Intensive Multi-Step Questions
2022/12/20 by Harsh Trivedi, Trivedi, Harsh, Niranjan Balasubramanian +5 · 320 citations
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Topic Modeling
paper · pdf · doi:10.48550/arxiv.2212.10509
openalex publication_date 2022/12/20 · openalex created_date 2023/01/04 · openalex updated_date 2026/07/28
Abstract
Prompting-based large language models (LLMs) are surprisingly powerful at generating natural language reasoning steps or Chains-of-Thoughts (CoT) for multi-step question answering (QA). They struggle, however, when the necessary knowledge is either unavailable to the LLM or not up-to-date within its parameters. While using the question to retrieve relevant text from an external knowledge source helps LLMs, we observe that this one-step retrieve-and-read approach is insufficient for multi-step QA. Here, what to retrieve depends on what has already been derived, which in turn may depend on what was previously retrieved. To address this, we propose IRCoT, a new approach for multi-step QA that interleaves retrieval with steps (sentences) in a CoT, guiding the retrieval with CoT and in turn using retrieved results to improve CoT. Using IRCoT with GPT3 substantially improves retrieval (up to 21 points) as well as downstream QA (up to 15 points) on four datasets: HotpotQA, 2WikiMultihopQA, MuSiQue, and IIRC. We observe similar substantial gains in out-of-distribution (OOD) settings as well as with much smaller models such as Flan-T5-large without additional training. IRCoT reduces model hallucination, resulting in factually more accurate CoT reasoning. Code, data, and prompts are available at \urlhttps://github.com/stonybrooknlp/ircot
Cited by
- DMA: Online RAG Alignment with Human Feedback
- A New Role for Relevance: Guiding Corpus Interaction in Agentic Search
- VecTree-RAG: An Agentic Retrieval-Augmented Generation Framework Combining Vector and Tree Retrieval for Efficiency and Accuracy
- Co-Evolving Graph and Text Memory for Training-Free Multi-Hop Question Answering
- ScalableRAG: High-Quality RAG at Zero Ingestion Cost
- When Thinking Before Retrieval Hurts: TraceBound Diagnostics for Adaptive Knowledge-Graph Retrieval
- HyCE-RAG: Hypergraph Chain-of-Evidence Retrieval-Augmented Generation for Explainable Multi-hop Question Answering
- Structure Over Scale: Schema-Constrained Causal Graphs for RAG
- SF-AMS: Strategic Forgetting for Structured Memory in LLM Agent
- Language-Coupled Reinforcement Learning for Multilingual Retrieval-Augmented Generation
- QuCo-RAG: Quantifying Uncertainty from the Pre-training Corpus for Dynamic Retrieval-Augmented Generation
- AdaSearch: Balancing Parametric Knowledge and Search in Large Language Models via Reinforcement Learning
- Leveraging Spreading Activation for Improved Document Retrieval in Knowledge-Graph-Based RAG Systems
- CoDA: A Context-Decoupled Hierarchical Agent with Reinforcement Learning
- Hybrid Retrieval-Augmented Generation for Robust Multilingual Document Question Answering
- VERAFI: Verified Agentic Financial Intelligence through Neurosymbolic Policy Generation
- PathFinder: MCTS and LLM Feedback-based Path Selection for Multi-Hop Question Answering
- Cooperative Retrieval-Augmented Generation for Question Answering: Mutual Information Exchange and Ranking by Contrasting Layers
- KBQA-R1: Reinforcing Large Language Models for Knowledge Base Question Answering
- RouteRAG: Efficient Retrieval-Augmented Generation from Text and Graph via Reinforcement Learning
- Source Coverage and Citation Bias in LLM-based vs. Traditional Search Engines
- LightSearcher: Efficient DeepSearch via Experiential Memory
- ChipMind: Retrieval-Augmented Reasoning for Long-Context Circuit Design Specifications
- Agentic Policy Optimization via Instruction-Policy Co-Evolution
- EmoRAG: Evaluating RAG Robustness to Symbolic Perturbations
- Context-Aware Pragmatic Metacognitive Prompting for Sarcasm Detection
- Reducing Latency of LLM Search Agent via Speculation-based Algorithm-System Co-Design
- Agent-as-a-Graph: Knowledge Graph-Based Tool and Agent Retrieval for LLM Multi-Agent Systems
- Parametric Retrieval-Augmented Generation using Latent Routing of LoRA Adapters
- MuISQA: Multi-Intent Retrieval-Augmented Generation for Scientific Question Answering
- NeuroPath: Neurobiology-Inspired Path Tracking and Reflection for Semantically Coherent Retrieval
- RAGSmith: A Framework for Finding the Optimal Composition of Retrieval-Augmented Generation Methods Across Datasets
- Modeling Uncertainty Trends for Timely Retrieval in Dynamic RAG
- Thinking Forward and Backward: Multi-Objective Reinforcement Learning for Retrieval-Augmented Reasoning
- DeepSpecs: Expert-Level Questions Answering in 5G
- Thinker: Training LLMs in Hierarchical Thinking for Deep Search via Multi-Turn Interaction
- Think Before You Retrieve: Learning Test-Time Adaptive Search with Small Language Models
- LGM: Enhancing Large Language Models with Conceptual Meta-Relations and Iterative Retrieval
- MemSearcher: Training LLMs to Reason, Search and Manage Memory via End-to-End Reinforcement Learning
- Beyond Single Embeddings: Capturing Diverse Targets with Multi-Query Retrieval
- Tool-to-Agent Retrieval: Bridging Tools and Agents for Scalable LLM Multi-Agent Systems
- PathFinder: Efficiently Supporting Conjunctions and Disjunctions for Filtered Approximate Nearest Neighbor Search
- Test-time Scaling of LLMs: A Survey from A Subproblem Structure Perspective
- TreeQA: Enhanced LLM-RAG with logic tree reasoning for reliable and interpretable multi-hop question answering
- Interact-RAG: Reason and Interact with the Corpus, Beyond Black-Box Retrieval
- SIGMA: Search-Augmented On-Demand Knowledge Integration for Agentic Mathematical Reasoning
- MARAG-R1: Beyond Single Retriever via Reinforcement-Learned Multi-Tool Agentic Retrieval
- Empowering RepoQA-Agent based on Reinforcement Learning Driven by Monte-carlo Tree Search
- Towards Global Retrieval Augmented Generation: A Benchmark for Corpus-Level Reasoning
- GAP: Graph-Based Agent Planning with Parallel Tool Use and Reinforcement Learning
- BM25 Wins at Scale: A Scaling Study of Retrieval-Augmented Generation Paradigms
- CMT-RAG: Complementary Memory Traces for Multi-turn Multi-hop RAG
- Beyond Self-Knowledge: Propagating Uncertainty Across Reasoning and Retrieval in LLMs
- WikiLoop: Jointly Learning to Build and Navigate Agent-Native Wikis with Downstream Feedback
- GroupRAG: Cognitively Inspired Group-Aware Retrieval and Reasoning via Knowledge-Driven Problem Structuring
- Optimizing Retrieval for RAG via Reinforced Contrastive Learning
- Mitigating Hallucination in Large Language Models (LLMs): An Application-Oriented Survey on RAG, Reasoning, and Agentic Systems
- Metadata-Driven Retrieval-Augmented Generation for Financial Question Answering
- FAIR-RAG: Faithful Adaptive Iterative Refinement for Retrieval-Augmented Generation
- Bridging Language Gaps with Adaptive RAG: Improving Indonesian Language Question Answering
- GlobalRAG: Enhancing Global Reasoning in Multi-hop Question Answering via Reinforcement Learning
- Think Parallax: Solving Multi-Hop Problems via Multi-View Knowledge-Graph-Based Retrieval-Augmented Generation
- Think Straight, Stop Smart: Structured Reasoning for Efficient Multi-Hop RAG
- WebSeer: Training Deeper Search Agents through Reinforcement Learning with Self-Reflection
- AcademicEval: Live Long-Context LLM Benchmark
- SafeSearch: Do Not Trade Safety for Utility in LLM Search Agents
- FinSight: Towards Real-World Financial Deep Research
- A Comprehensive Survey on Reinforcement Learning-based Agentic Search: Foundations, Roles, Optimizations, Evaluations, and Applications
- Cost-Aware Retrieval-Augmentation Reasoning Models with Adaptive Retrieval Depth
- EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle
- An Efficient Rubric-based Generative Verifier for Search-Augmented LLMs
- PluriHop: Exhaustive, Recall-Sensitive QA over Distractor-Rich Corpora
- Stop-RAG: Value-Based Retrieval Control for Iterative RAG
- PRISM: Agentic Retrieval with LLMs for Multi-Hop Question Answering
- Learnable Game-theoretic Policy Optimization for Data-centric Self-explanation Rationalization
- Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation
- Understanding Parametric Knowledge Injection in Retrieval-Augmented Generation
- CTIConnect: A Benchmark for Retrieval-Augmented LLMs over Heterogeneous Cyber Threat Intelligence
- Query-Specific GNN: A Comprehensive Graph Representation Learning Method for Retrieval Augmented Generation
- Uncertainty Quantification for Retrieval-Augmented Reasoning
- VeriCite: Towards Reliable Citations in Retrieval-Augmented Generation via Rigorous Verification
- LLM-Specific Utility: A New Perspective for Retrieval-Augmented Generation
- BrowserAgent: Building Web Agents with Human-Inspired Web Browsing Actions
- RECON: Reasoning with Condensation for Efficient Retrieval-Augmented Generation
- Beyond the limitation of a single query: Train your LLM for query expansion with Reinforcement Learning
- Meta-Harness: End-to-End Optimization of Model Harnesses
- STEPER: Step-wise Knowledge Distillation for Enhancing Reasoning Ability in Multi-Step Retrieval-Augmented Language Models
- HiPRAG: Hierarchical Process Rewards for Efficient Agentic Retrieval Augmented Generation
- QAgent: A modular Search Agent with Interactive Query Understanding
- A2Search: Ambiguity-Aware Question Answering with Reinforcement Learning
- Benchmarking Chinese Commonsense Reasoning with a Multi-hop Reasoning Perspective
- When Thoughts Meet Facts: Reusable Reasoning for Long-Context LMs
- Haystack Engineering: Context Engineering for Heterogeneous and Agentic Long-Context Evaluation
- TIGeR: Tool-Integrated Geometric Reasoning in Vision-Language Models for Robotics
- Stratified GRPO: Handling Structural Heterogeneity in Reinforcement Learning of LLM Search Agents
- DecEx-RAG: Boosting Agentic Retrieval-Augmented Generation with Decision and Execution Optimization via Process Supervision
- CAM: A Constructivist View of Agentic Memory for LLM-Based Reading Comprehension
- RLAD: Training LLMs to Discover Abstractions for Solving Reasoning Problems
- Beyond Outcome Reward: Decoupling Search and Answering Improves LLM Agents
- Multi-Hop Question Answering: When Can Humans Help, and Where do They Struggle?
- TRAJECT-Bench:A Trajectory-Aware Benchmark for Evaluating Agentic Tool Use
- Large Language Models Hallucination: A Comprehensive Survey
- Less Diverse, Less Safe: The Indirect But Pervasive Risk of Test-Time Scaling in Large Language Models
- One More Question is Enough, Expert Question Decomposition (EQD) Model for Domain Quantitative Reasoning
- TaskCraft: Automated Generation of Agentic Tasks
- Learning to Route: A Rule-Driven Agent Framework for Hybrid-Source Retrieval-Augmented Generation
- RE-Searcher: Robust Agentic Search with Goal-oriented Planning and Self-reflection
- ReTAG: Retrieval-Enhanced, Topic-Augmented Graph-Based Global Sensemaking
- Hybrid Reward Normalization for Process-supervised Non-verifiable Agentic Tasks
- Beyond Static Retrieval: Opportunities and Pitfalls of Iterative Retrieval in GraphRAG
- AceSearcher: Bootstrapping Reasoning and Search for LLMs via Reinforced Self-Play
- G-reasoner: Foundation Models for Unified Reasoning over Graph-structured Knowledge
- Not Wrong, But Untrue: LLM Overconfidence in Document-Based Queries
- PaperSearchQA: Learning to Search and Reason over Scientific Papers with RLVR
- Think-on-Graph 3.0: Efficient and Adaptive LLM Reasoning on Heterogeneous Graphs via Multi-Agent Dual-Evolving Context Retrieval
- What Should I Cite? A RAG Benchmark for Academic Citation Prediction
- Eigen-1: Adaptive Multi-Agent Refinement with Monitor-Based RAG for Scientific Reasoning
- Harness-G: A Graph-Structured Harness for Search Agents
- Dr-DCI: Scaling Direct Corpus Interaction via Dynamic Workspace Expansion
- Retrieval Feedback Memory Enhancement Large Model Retrieval Generation Method
- Advances in Large Language Models for Medicine
- Understanding Benchmark Language Under Weakened Formal Semantics
- Enhancing Retrieval Augmentation via Adversarial Collaboration
- Who Taught the Lie? Responsibility Attribution for Poisoned Knowledge in Retrieval-Augmented Generation
- Metacognitive Reuse: Turning Recurring LLM Reasoning Into Concise Behaviors
- Deploying AI for Signal Processing education: Selected challenges and intriguing opportunities
- Learning from Diverse Reasoning Paths with Routing and Collaboration
- HANRAG: Heuristic Accurate Noise-resistant Retrieval-Augmented Generation for Multi-hop Question Answering
- Chain or tree? Re-evaluating complex reasoning from the perspective of a matrix of thought
- OPERA: A Reinforcement Learning--Enhanced Orchestrated Planner-Executor Architecture for Reasoning-Oriented Multi-Hop Retrieval
- KoBLEX: Open Legal Question Answering with Multi-hop Reasoning
- Towards Open-World Retrieval-Augmented Generation on Knowledge Graph: A Multi-Agent Collaboration Framework
- VerlTool: Towards Holistic Agentic Reinforcement Learning with Tool Use
- MMAPG: A Training-Free Framework for Multimodal Multi-hop Question Answering via Adaptive Planning Graphs
- Progressive Multimodal Search and Reasoning for Knowledge-Intensive Visual Question Answering
- Decomposing and Revising What Language Models Generate
- EviNote-RAG: Enhancing RAG Models via Answer-Supportive Evidence Notes
- Open Data Synthesis For Deep Research
- Exploring Reasoning-Infused Text Embedding with Large Language Models for Zero-Shot Dense Retrieval
- KG-CQR: Leveraging Structured Relation Representations in Knowledge Graphs for Contextual Query Retrieval
- AI-SearchPlanner: Modular Agentic Search via Pareto-Optimal Multi-Objective Reinforcement Learning
- TinyServe: Query-Aware Cache Selection for Efficient LLM Serving
- Can Compact Language Models Search Like Agents? Distillation-Guided Policy Optimization for Preserving Agentic RAG Capabilities
- Hybrid Deep Searcher: Integrating Parallel and Sequential Search Reasoning
- Test-time Corpus Feedback: From Retrieval to RAG
- Thinking Before You Speak: A Proactive Test-time Scaling Approach
- FLAIR: Feedback Learning for Adaptive Information Retrieval
- Cross-Granularity Hypergraph Retrieval-Augmented Generation for Multi-hop Question Answering
- MoNaCo: More Natural and Complex Questions for Reasoning Across Dozens of Documents
- ComoRAG: A Cognitive-Inspired Memory-Organized RAG for Stateful Long Narrative Reasoning
- Inductive Bias Extraction and Matching for LLM Prompts
- ParallelSearch: Train your LLMs to Decompose Query and Search Sub-queries in Parallel with Reinforcement Learning
- KG-o1: Enhancing Multi-hop Question Answering in Large Language Models via Knowledge Graph Integration
- You Don't Need Pre-built Graphs for RAG: Retrieval Augmented Generation with Adaptive Reasoning Structures
- CoCoLex: Confidence-guided Copy-based Decoding for Grounded Legal Text Generation
- LAG: Logic-Augmented Generation from a Cartesian Perspective
- MultiRAG: A Knowledge-guided Framework for Mitigating Hallucination in Multi-source Retrieval Augmented Generation
- Beyond Chunks and Graphs: Retrieval-Augmented Generation through Triplet-Driven Thinking
- LMAR: Language Model Augmented Retriever for Domain-specific Knowledge Indexing
- CoCoA: Collaborative Chain-of-Agents for Parametric-Retrieved Knowledge Synergy
- A Survey of LLM-based Deep Search Agents: Paradigm, Optimization, Evaluation, and Challenges
- From Query to Logic: Ontology-Driven Multi-Hop Reasoning in LLMs
- Lucy: edgerunning agentic web search on mobile with machine generated task vectors
- From Sufficiency to Reflection: Reinforcement-Guided Thinking Quality in Retrieval-Augmented Reasoning for LLMs
- Learning to Extract Rational Evidence via Reinforcement Learning for Retrieval-Augmented Generation
- DeepSieve: Information Sieving via LLM-as-a-Knowledge-Router
- RAG in the Wild: On the (In)effectiveness of LLMs with Mixture-of-Knowledge Retrieval Augmentation
- Trustworthy Reasoning: Evaluating and Enhancing Factual Accuracy in LLM Intermediate Thought Processes
- A Systematic Review of Key Retrieval-Augmented Generation (RAG) Systems: Progress, Gaps, and Future Directions
- Injecting External Knowledge into the Reasoning Process Enhances Retrieval-Augmented Generation
- From Roots to Rewards: Dynamic Tree Reasoning with Reinforcement Learning
- MemGraphRAG: Memory-based Multi-Agent System for Graph Retrieval-Augmented Generation
- PRGB Benchmark: A Robust Placeholder-Assisted Algorithm for Benchmarking Retrieval-Augmented Generation
- DynaSearcher: Dynamic Knowledge Graph Augmented Search Agent via Multi-Reward Reinforcement Learning
- Am I on the Right Track? What Can Predicted Query Performance Tell Us about the Search Behaviour of Agentic RAG
- Towards Agentic RAG with Deep Reasoning: A Survey of RAG-Reasoning Systems in LLMs
- Clue-RAG: Towards Accurate and Cost-Efficient Graph-based RAG via Multi-Partite Graph and Query-Driven Iterative Retrieval
- FrugalRAG: Learning to retrieve and reason for multi-hop QA
- Shifting from Ranking to Set Selection for Retrieval Augmented Generation
- A Survey of Pun Generation: Datasets, Evaluations and Methodologies
- Beyond Independent Passages: Adaptive Passage Combination Retrieval for Retrieval Augmented Open-Domain Question Answering
- When Iterative RAG Beats Ideal Evidence: A Diagnostic Study in Scientific Multi-hop Question Answering
- MobileRAG: A Fast, Memory-Efficient, and Energy-Efficient Method for On-Device RAG
- Towards Robustness: A Critique of Current Vector Database Assessments
- RAG-R1: Incentivizing the Search and Reasoning Capabilities of LLMs through Multi-query Parallelism
- π-CoT: Prolog-Initialized Chain-of-Thought Prompting for Multi-Hop Question-Answering
- KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models
- Retrieval-Confused Generation is a Good Defender for Privacy Violation Attack of Large Language Models
- Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation
- From Web Search towards Agentic Deep Research: Incentivizing Search with Reasoning Agents
- Resource-Friendly Dynamic Enhancement Chain for Multi-Hop Question Answering
- KAG-Thinker: Interactive Thinking and Deep Reasoning in LLMs via Knowledge-Augmented Generation
- SGIC: A Self-Guided Iterative Calibration Framework for RAG
- SimpleDoc: Multi-Modal Document Understanding with Dual-Cue Page Retrieval and Iterative Refinement
- Chain of Methodologies: Scaling Test Time Computation without Training
- Maximally-Informative Retrieval for State Space Model Generation
- Constructing and Evaluating Declarative RAG Pipelines in PyTerrier
- KG-Infused RAG: Augmenting Corpus-Based RAG with External Knowledge Graphs
- Bridging External and Parametric Knowledge: Mitigating Hallucination of LLMs with Shared-Private Semantic Synergy in Dual-Stream Knowledge
- BioMol-MQA: A Multi-Modal Question Answering Dataset For LLM Reasoning Over Bio-Molecular Interactions
- From Standalone LLMs to Integrated Intelligence: A Survey of Compound Al Systems
- Neural Network Reprogrammability: A Unified Theme on Model Reprogramming, Prompt Tuning, and Prompt Instruction
- R-Search: Empowering LLM Reasoning with Search via Multi-Reward Reinforcement Learning
- Verification Without Sufficiency: Per-Chunk Filtering Fails on Multi-Hop RAG, and Decomposition Repairs It
- LLM-Independent Adaptive RAG: Let the Question Speak for Itself
- KARE-RAG: Knowledge-Aware Refinement and Enhancement for RAG
- Expanding before Inferring: Enhancing Factuality in Large Language Models through Premature Layers Interpolation
- ImpRAG: Retrieval-Augmented Generation with Implicit Queries
- CiteEval: Principle-Driven Citation Evaluation for Source Attribution
- Do not Abstain! Identify and Solve the Uncertainty
- TreeRare: Syntax Tree-Guided Retrieval and Reasoning for Knowledge-Intensive Question Answering
- Optimizing Question Semantic Space for Dynamic Retrieval-Augmented Multi-hop Question Answering
- ClueAnchor: Clue-Anchored Knowledge Reasoning Exploration and Optimization for Retrieval-Augmented Generation
- MIR: Methodology Inspiration Retrieval for Scientific Research Problems
- Context is Gold to find the Gold Passage: Evaluating and Training Contextual Document Embeddings
- DeepDiver: Adaptive Search Intensity Scaling via Open-Web Reinforcement Learning
- Agent-UniRAG: A Trainable Open-Source LLM Agent Framework for Unified Retrieval-Augmented Generation Systems
- Learning to Route Queries Across Knowledge Bases for Step-wise Retrieval-Augmented Reasoning
- Xinyu AI Search: Enhanced Relevance and Comprehensive Results with Rich Answer Presentations
- Scaling External Knowledge Input Beyond Context Windows of LLMs via Multi-Agent Collaboration
- Knowing You Don't Know: Learning When to Continue Search in Multi-round RAG through Self-Practicing
- Will It Still Be True Tomorrow? Multilingual Evergreen Question Classification to Improve Trustworthy QA
- Test-Time Learning for Large Language Models
- ReSCORE: Label-free Iterative Retriever Training for Multi-hop Question Answering with Relevance-Consistency Supervision
- R3-RAG: Learning Step-by-Step Reasoning and Retrieval for LLMs via Reinforcement Learning
- NeuSym-RAG: Hybrid Neural Symbolic Retrieval with Multiview Structuring for PDF Question Answering
- Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers
- KnowTrace: Bootstrapping Iterative Retrieval-Augmented Generation with Structured Knowledge Tracing
- Hierarchical Retrieval with Evidence Curation for Open-Domain Financial Question Answering on Standardized Documents
- Incorporating Legal Structure in Retrieval-Augmented Generation: A Case Study on Copyright Fair Use
- Self-Critique Guided Iterative Reasoning for Multi-hop Question Answering
- Removal of Hallucination on Hallucination: Debate-Augmented RAG
- HindSearch: Trajectory-Level Hindsight Critique for Search-Augmented Reinforcement Learning
- GainRAG: Preference Alignment in Retrieval-Augmented Generation through Gain Signal Synthesis
- Benchmarking Poisoning Attacks against Retrieval-Augmented Generation
- Hybrid Latent Reasoning via Reinforcement Learning
- AcuRank: Uncertainty-Aware Adaptive Computation for Listwise Reranking
- DocNavRAG: Document-Structured Graph RAG with Stateful Evidence Construction for Complex Document Question Answering
- From Reasoning to Generalization: Knowledge-Augmented LLMs for ARC Benchmark
- LeTS: Learning to Think-and-Search via Process-and-Outcome Reward Hybridization
- T2: An Adaptive Test-Time Scaling Strategy for Contextual Question Answering
- Misaligning Reasoning with Answers -- A Framework for Assessing LLM CoT Robustness
- Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation
- RaDeR: Reasoning-aware Dense Retrieval Models
- Search Wisely: Mitigating Sub-optimal Agentic Searches By Reducing Uncertainty
- MEGRAG: Multi-Granular Evidence Graphs for Answer-Aware Multi-Hop RAG
- R1-Searcher++: Incentivizing the Dynamic Knowledge Acquisition of LLMs via Reinforcement Learning
- Tool-Star: Empowering LLM-Brained Multi-Tool Reasoner via Reinforcement Learning
- O2-Searcher: A Searching-based Agent Model for Open-Domain Open-Ended Question Answering
- Two-way Evidence self-Alignment based Dual-Gated Reasoning Enhancement
- SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
- Augmenting LLM Reasoning with Dynamic Notes Writing for Complex QA
- HALT: Verification-Aware Stopping for Retrieval-Augmented Search Agents
- Fetch-then-Explore: Decoupling Selection from Extraction over a Persistent Workspace for Search Agents
- Scaling Physical Reasoning with the PHYSICS Dataset
- Single LLM, Multiple Roles: A Unified Retrieval-Augmented Generation Framework Using Role-Specific Token Optimization
- StepSearch: Igniting LLMs Search Ability via Step-Wise Proximal Policy Optimization
- Before Reasoning Can Fail: Pre-Evidence Procedural Failures in Agentic RAG
- An Empirical Study on Reinforcement Learning for Reasoning-Search Interleaved LLM Agents
- Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning
- Search-GRT: Guided Retrieval Training of Search Agents to Optimize for Complex Question Answering
- s3: You Don't Need That Much Data to Train a Search Agent via RL
- PROGRESS: Coverage-guided RL to Train Search-augmented LLM Agent
- Process vs. Outcome Reward: Which is Better for Agentic RAG Reinforcement Learning
- Transparent and Robust RAG: Adaptive-Reward Reinforcement Learning for Decision Traceability
- Know3-RAG: A Knowledge-aware RAG Framework with Adaptive Retrieval, Generation, and Filtering
- Accelerating Adaptive Retrieval Augmented Generation via Instruction-Driven Representation Reduction of Retrieval Overlaps
- PMMC: Prospective Multimodal Memory Compilation for Long-Term LVLM Agents
- Neuro-Symbolic Query Compiler
- BELLE: A Bi-Level Multi-Agent Reasoning Framework for Multi-Hop Question Answering
- Demystifying and Enhancing the Efficiency of Large Language Model Based Search Agents
- SubGCache: Accelerating Graph-based RAG with Subgraph-level KV Cache
- Masking in Multi-hop QA: An Analysis of How Language Models Perform with Context Permutation
- Search and Refine During Think: Facilitating Knowledge Refinement for Improved Retrieval-Augmented Reasoning
- Scent of Knowledge: Optimizing Search-Enhanced Reasoning with Information Foraging
- GraphER: An Efficient Graph-Based Enrichment and Reranking Method for Retrieval-Augmented Generation
- IterKey: Iterative Keyword Generation with LLMs for Enhanced Retrieval Augmented Generation
- Reliable Post-Retrieval Assembly for Agent Memory: Separating Evidence Extraction from Policy Execution
- SEM: Reinforcement Learning for Search-Efficient Large Language Models
- Internet of Agents: Fundamentals, Applications, and Challenges
- Benchmarking Retrieval-Augmented Generation for Chemistry
- DynamicRAG: Leveraging Outputs of Large Language Model as Feedback for Dynamic Reranking in Retrieval-Augmented Generation
- Reinforced Internal-External Knowledge Synergistic Reasoning for Efficient Adaptive Search Agent
- Why Uncertainty Estimation Methods Fall Short in RAG: An Axiomatic Analysis
- Courtroom-Style Multi-Agent Debate with Progressive RAG and Role-Switching for Controversial Claim Verification
- Decoupling Search from Reasoning: A Vendor-Agnostic Grounding Architecture for LLM Agents
- Structured Linked Data as a Memory Layer for Agent-Orchestrated Retrieval
- FLARE: Few-shot Learning-based Adaptive Reflective Engine
- Failure is Feedback: History-Aware Backtracking for Agentic Traversal in Multimodal Graphs
- Truncated Step-Level Sampling with Process Rewards for Retrieval-Augmented Reasoning
- Panini: Continual Learning in Token Space via Structured Memory
- Efficient RAG with Intent-Aware Retrieval and Semantics-Preserving Chunking
- State Representation and Termination for Recursive Reasoning Systems
- ReasonIR: Training Retrievers for Reasoning Tasks
- Beyond Parallel Sampling: Diverse Query Initialization for Agentic Search
- STEM: Structure-Tracing Evidence Mining for Knowledge Graphs-Driven Retrieval-Augmented Generation
- Stateful Evidence-Driven Retrieval-Augmented Generation with Iterative Reasoning
- Coding Agents are Effective Long-Context Processors
- Thinking to Recall: How Reasoning Unlocks Parametric Knowledge in LLMs
- SE-Search: Self-Evolving Search Agent via Memory and Dense Reward
- G2-Reader: Dual Evolving Graphs for Multimodal Document QA
- BAPO: Boundary-Aware Policy Optimization for Reliable Agentic Search
- DataParasite Enables Scalable and Repurposable Online Data Curation
- DualRAG: A Dual-Process Approach to Integrate Reasoning and Retrieval for Multi-Hop Question Answering
- PropRAG: Guiding Retrieval with Beam Search over Proposition Paths
- Adaptive Orchestration of Modular Generative Information Access Systems
- Credible Plan-Driven RAG Method for Multi-Hop Question Answering
- Search, Inspect, Fetch: Exploiting Structure-Aware Boolean Retrieval for Deep-Research Agents
- Collab-RAG: Boosting Retrieval-Augmented Generation for Complex Question Answering via White-Box and Black-Box LLM Collaboration
- Recall Is Not Enough: A Reader-Context Diagnostic for Budget-Constrained Retrieval-Augmented Generation
- Synergizing RAG and Reasoning: A Systematic Review
- Retrieval Augmented Generation Evaluation in the Era of Large Language Models: A Comprehensive Survey
- HERALD: Counterfactual Audits and Minimal Repairs for Proof-of-Retrieval Rewards
- Contextual Information Policy Optimization for Search Agents
- Trace Only What You Need: Structure-Aware On-Demand Hypergraph Memory for Long-Document Question Answering
- NodeRAG: Structuring Graph-based RAG with Heterogeneous Nodes
- ReZero: Enhancing LLM search ability by trying one-more-time
- DioR: Adaptive Cognitive Detection and Contextual Retrieval Optimization for Dynamic Retrieval-Augmented Generation
- A System for Comprehensive Assessment of RAG Frameworks
- Flow State: Humans Enabling AI Systems to Program Themselves
Related