Machine Learning Mastery· Iván Palomares Carrascosa·· 5 小时前AI 评分41
评估 Graph-RAG 与标准 RAG:事实密集型查询中的幻觉基准测试
Evaluating Graph-RAG vs. Standard RAG: A Hallucination Benchmark on Fact-Dense Queries
AI 导读
评估基准在合成的事实密集型体育数据上,对比确定性的 3-Tiered Graph-RAG 与标准向量 RAG 的查询表现。实验使用 ChromaDB、QuadStore 和本地 google/flan-t5-base 模型,为 50 名篮球球员生成含矛盾文本的数据,并将真实事实存入图数据库。测试重点考察提示词复杂度与模型能力的匹配及其对幻觉的影响。
来源:Machine Learning Mastery · machinelearningmastery.com