AI 参考文献真实率排行榜
同一套问法,逐条对数据库。测得真实率和宜引率。
真实率:对 AI 输出文献的最基本要求,确有这篇文献,能定位到数据库或期刊官网的记录。部分字段可能和来源有出入。
宜引率:引文真实,字段正确且完整,条目可直接引用。
1
ChatGPT
网页免费版默认 / 思考
宜引 61% · 测于 2026 年 9 月 8 日
80%真实 49 / 61
1
ChatGPT
网页免费版默认 / 思考
宜引 61% · 测于 2026 年 9 月 8 日
80%真实 49 / 61
2
豆包
网页版快速 / 专家
宜引 45% · 测于 2026 年 8 月 22 日
73%真实 45 / 62
2
豆包
网页版快速 / 专家
宜引 45% · 测于 2026 年 8 月 22 日
73%真实 45 / 62
3
DeepSeek
网页版默认 / 深思
宜引 24% · 测于 2026 年 9 月 14 日
50%真实 33 / 66
3
DeepSeek
网页版默认 / 深思
宜引 24% · 测于 2026 年 9 月 14 日
50%真实 33 / 66
逐家对比:模式 × 问法
怎么测的
三个问法,不同模式,同样的任务。为能真实反映日常使用情况,未做多次采样求平均,直接取第一次输出内容为材料,将其输出的参考文献逐条与学术数据库和期刊官网等进行核对。
判定标准
- 真实:确有这篇文献,能定位到数据库或期刊官网的记录。
- 完整:按其输出的体例要求,该写的著录项都写了,而且和真实记录一致。
- 宜引:又真实又完整,可以直接引用。