Artificial Intelligence #benchmark#academic search
ScholarQuest Benchmark Reveals Gaps in Agentic Academic Paper Search for Enterprise AI
A new benchmark called ScholarQuest evaluates LLM-based agents for academic paper search. Built from over 1,000 computer science topics and four research intents, it provides scalable answer construction and a shared retrieval backend. Results show agentic methods beat single-shot retrieval but the top agent only achieves 0.314 Recall@100, indicating significant room for improvement in agentic search.
Jul 8, 2026 1 source