返回工具列表
AgenticRAGTracer
AgenticRAGTracer 是一个面向 Agentic RAG 的 Hop-Aware 评测基准,用于诊断多步检索推理能力,已被 ACL 2026 Findings 接收。
工具简介
AgenticRAGTracer 解决的是 Agentic RAG 中多步检索推理缺乏系统性诊断工具的问题。传统 RAG 评测大多关注单跳检索准确率,难以反映 Agent 在多次检索中逐步推理的实际表现。
该项目提供了一个多跳评测管线:核心组件包括 multihop_pipeline.py(多跳生成管线)、multihop_run.py(并行运行器)和 multihop_prompt.yaml(提示模板)。典型场景包括 RAG 系统的多步检索推理能力评估、Agent 检索策略的回归测试,以及论文复现与对比实验。
它的优点是 ACL 2026 Findings 论文背书、结构清晰可直接运行;需要注意的是项目仍处于早期阶段(14 stars、1 fork),社区生态和文档尚不完善。如果你在意评测覆盖面和稳定性,需要关注后续更新频率。
更适合从事 RAG 或 Agent 检索研究的学术团队和工程师,不太适合生产环境中作为唯一的质量门禁工具。