PublicationNational Institute of Technology Delhi · 2025
MARL-MAPS: Dynamic Multi-Agent Reinforcement Learning for Optimized RAG
Kumar Priyam
Traditional Retrieval-Augmented Generation (RAG) pipelines suffer from a "Context Tax" — bloating LLM inputs with noisy, irrelevant documents that spike latency and increase hallucination risks. Sequential one-way pipelines prevent adaptive backtracking when early retrieval steps…
Multi-Agent RLRAG OptimizationDec-POMDPLLM SystemsInformation Retrieval
Read full paper