首发活动:通行卡优惠低至 7 折;新用户注册赠送 30 积分立即体验

AI 参考文献真实率排行榜

同一套问法,逐条对数据库。测得真实率和宜引率。

真实率:对 AI 输出文献的最基本要求,确有这篇文献,能定位到数据库或期刊官网的记录。部分字段可能和来源有出入。

宜引率:引文真实,字段正确且完整,条目可直接引用。

去核验
真实率怎么测的宜引(真实+完整)真实错配或编造
1
ChatGPT
网页免费版默认 / 思考
宜引 61% · 测于 2026 年 9 月 8 日
80%真实 49 / 61
2
豆包
网页版快速 / 专家
宜引 45% · 测于 2026 年 8 月 22 日
73%真实 45 / 62
3
DeepSeek
网页版默认 / 深思
宜引 24% · 测于 2026 年 9 月 14 日
50%真实 33 / 66

逐家对比:模式 × 问法

ChatGPT网页免费版
80%真实宜引 61% · 共 61 条
随手问提要求列要点
默认「思考」关91%70%90%
思考「思考」开70%90%70%
测评全文 →
豆包网页版
73%真实宜引 45% · 共 62 条
随手问提要求列要点
快速默认模型100%10%100%
专家「专家」模式70%50%100%
测评全文 →
DeepSeek网页版
50%真实宜引 24% · 共 66 条
随手问提要求列要点
默认联网开、深思关67%40%40%
深思联网、深思全开35%50%80%
测评全文 →

怎么测的

三个问法,不同模式,同样的任务。为能真实反映日常使用情况,未做多次采样求平均,直接取第一次输出内容为材料,将其输出的参考文献逐条与学术数据库和期刊官网等进行核对。

判定标准

  • 真实:确有这篇文献,能定位到数据库或期刊官网的记录。
  • 完整:按其输出的体例要求,该写的著录项都写了,而且和真实记录一致。
  • 宜引:又真实又完整,可以直接引用。

三种问法