CiteTrue 对比 Zotero
Zotero 把自己的事做得很好:收集文献、管理条目、生成规范的引用格式。但要说清楚,这和"核查"是两件事 —— 你把一条伪造的引用放进 Zotero,它会一声不吭地给你排成完美的 APA 格式,因为"这篇文献是否存在"从来不是它的职责。
为什么我们的结论站得住
多数引用核查工具把判断整个交给大模型,再把模型说的话展示给你。可模型会产生幻觉 —— 这恰恰是这个品类存在的原因。所以我们把模型放在最后一步,而不是第一步。
- 01
1. 先解析,不猜
每条引用先由针对引用格式写的解析器拆成作者、标题、年份、期刊、DOI,而不是问模型「你觉得标题是哪段」。
- 02
2. 到权威库里查
拿解析出来的字段去 Crossref、OpenAlex 检索;没有 DOI 的再查开放网络。拿回来的是带真实标识符的真实记录。
- 03
3. 用确定性算法打分
候选记录用 Sørensen-Dice 对标题分词打相似度。标题分数过 0.7,并且作者也对得上,才算匹配成功;年份对不上会作为提示单独标出,不会被悄悄放过。同一条引用,每次算出来的分数都一样。
- 04
4. 到这一步才请模型出场
只有当确定性匹配没能找出可信结果时,才调用大模型 —— 让它读候选记录和原文,判断有没有对得上的。它是兜底,不是裁判。这个顺序决定了幻觉没有入口:轮到模型时,证据已经摆在桌面上了。
落到实处就是:这里标为可信的引用,是在标题和作者两个维度上匹配到了一条真实记录,而且你可以点开那条记录 —— 而不是模型觉得这条引用「看起来像真的」。
跑完一份参考文献要多久
核查一条引用意味着在多个来源里查好几次。一条一条排队跑,正是长参考文献让人等到不耐烦的原因。我们让它们并行跑,并且边跑边把结果推回来。
- 并行核查条数
- 应用内 20 条同时跑,API 放宽到 100 条
- 一份 50 条的参考文献
- 拆成三批并行查,而不是排成五十个队列
- 出结果的方式
- 逐条流式返回 —— 前面的结论已经能看,后面的还在跑
- 批量场景
- 一摞学生论文走 API,并发是应用内的五倍
各自擅长什么
| 对比项 | CiteTrue | Zotero |
|---|---|---|
| 本职工作 | 核查引用是否真实、是否引对了 | 收集、整理、格式化文献 |
| 手动录入的一条伪造引用 | 会被标出来,并说明原因 | 会被完美排版,不会提示任何问题 |
| 从 AI 草稿里粘来的参考文献 | 逐条与文献库比对核实 | DOI 能解析就照单导入,否则手动录入 |
| 引用格式化 | 不是我们的活 —— 这件事继续用 Zotero | 几千种格式,做得很好 |
| 费用 | 每天 30 条免费,之后 $5.99/月起 | 免费开源,存储另收费 |
| 便捷度 | 粘贴参考文献,或直接用浏览器扩展查 | 桌面应用 + 浏览器插件 |
那到底该用哪个?
这两个是互补,不是替代。Zotero 让你的文献库井井有条,CiteTrue 告诉你里面的东西是不是真的。如果你的引用来自 AI 工具,先过一遍 CiteTrue 再入库。