Chuan Check 学术诚信调查法
核心原则
按“硬证据优先,网络扩展随后,官方状态收口”推进。
- 先证明文章有什么问题,再调查谁与谁有关。
- 先核对论文原文,再采用搜索摘要、AI报告或网友说法。
- 将事实、推断、线索和待核问题分开书写。
- 允许表达尖锐,但不让修辞替代证据。
- 姓名、国籍、院校层次、跨国合作、单位数量和产出模式都可以触发并扩大检索;归属与定性需要进一步使用身份锚点、文章级对应和官方记录确认。
- 学术不端的最终认定属于期刊、出版商或研究机构;调查报告只陈述可复核证据和风险判断。
调查总流程
1. 固定调查对象
建立对象清单:
- 论文题名、作者、单位、期刊、DOI、投稿与发表日期;
- 用户提出的具体主张;
- 可疑原文、相关论文和官方通知;
- 同名作者的身份区分信息。
先写一句可证伪的问题,例如:“目标论文的图1—7是否来自来源论文?”同时把作者身份、合作网络和出版流程列为并行的调查线索,逐步寻找可验证的关联。
2. 获取并保存一手材料
优先级:
- 出版社正式PDF、补充材料、勘误、关注声明和撤稿通知;
- 机构知识库中的正式作者稿或出版版本;
- Crossref、ORCID、机构主页等结构化记录;
- 学术数据库和可靠调查报道;
- 搜索摘要、社交媒体和AI报告,仅作为线索。
记录访问日期和版本。PDF比较必须使用完整版本,不能只依赖搜索片段。
3. 从不可辩解的硬伤切入
逐页检查:
- 地图、坐标、地名、国界、研究区及前后漂移;
- 日期、样本量、设备、车辆、实验地点和物种等内部矛盾;
- 图片截图、裁边、分辨率突变、乱码、虚构标签、图序错乱;
- 图表是否回答研究问题,表格与正文数值是否一致;
- 公式、参数、结果和结论是否与另一论文高度重合;
- 参考文献是否支持对应陈述。
做完整调查时读取 investigation-checklist.md。
4. 溯源而非停在“像AI”
使用最有辨识度的元素寻找来源:
- 罕见数值组合、坐标、日期和设备型号;
- 图题、表题、连续短语和异常措辞;
- 散点形状、时序波形、路线地图和图形摘要;
- 参考文献中主题最接近的早期论文。
找到候选来源后,建立逐项对照账本。至少记录目标页码、来源页码、对应内容、匹配类型和可替代解释。使用 evidence-ledger.md 的字段。
遇到疑似“改写旧研究”时,优先把可检索的数值、表格和样本残留作为指纹:连续系数/标准误、观测数、模型诊断量、地区分组、排除样本、数据集覆盖年份和变量定义。用这些指纹反向检索更早来源,再做页表级核对;不要只比较题名或单个句子。完整操作见 field-protocols.md。
图像比较同时保留:
- 原始嵌入文件的加密哈希,用于识别字节级重复;
- 页面渲染后的感知哈希,用于识别截图、压缩、缩放和重新编码;
- 人工逐图核对,用于确认局部复制、重排、改色和数据形状一致。
“原始哈希不相同”不能排除截图或重新编码复制;“感知哈希接近”也不能单独证明不当复用。
5. 从文章扩展到网络
在文章级问题已经明确的基础上,沿作者、机构、合作和出版记录扩大筛查:
- 直接共同署名关系;
- 相同论文、特刊、处理编辑或客座编辑;
- 引用是否集中于特定作者且与正文无关;
- 作者单位、邮箱、ORCID和姓名拼写是否异常变化;
- 接收稿与发表稿之间是否发生异常作者增删;
- 合作者是否有官方撤稿、关注声明或同行评审受损记录;
- 发文时间、主题跨度和产出密度是否异常。
同名消歧至少结合两项:ORCID、机构、邮箱、稳定合作者、题名/DOI。无法消歧时明确写“可能同名,尚未确认”。
网络关系分为:
- 直接连接:共同署名、共同编辑、直接引用或官方通知点名;
- 间接连接:共享多名合作者、特刊或异常引用群;
- 模式相似:国别组合、单位类型、主题模板等,仅作检索线索。
不得把某位合作者的撤稿记录自动归责于网络中的其他作者。
作者网络用于扩大核查范围、寻找可验证关联和完成同名消歧。对常见姓名,结合 DOI、ORCID、机构邮箱、单位时间线或稳定合作关系完成身份锚定;“同名”“国籍”“跨国合作”“单位变动”可以先记录为线索,再根据后续材料更新其状态。
6. 核查出版流程与官方结果
检查:
- 投稿、修回、接收时间是否与工作量相称;
- 是否属于特刊及其编辑构成;
- 官方记录是否提到作者身份、作者变更、引用操纵、同行评审受损、AI材料、抄袭或论文工厂;
- 作者是否被要求提供原始数据,回应是否令人满意;
- 文章当前状态:正常、勘误、关注声明、撤稿或撤回。
特刊、很短审稿周期或严格查重阈值均不能单独推出编辑部参与不端。把“文章问题”和“流程问题”分为两条证据链:前者先由原文证明,后者再核对客座编辑、处理编辑、稿件版本和官方调查结果。
引用官方通知时区分“通知确认了什么”和“通知没有确认什么”。如果通知没有分配个人责任,不代替期刊指认具体作者知情。
7. 证据分级与结论
给每项发现分级:
- A 级:论文原文、原始PDF、官方通知或可重复计算直接证明;
- B 级:多项独立材料一致支持,仍存在有限替代解释;
- C 级:网络或模式异常,适合继续追查;
- D 级:传闻、AI推测、身份猜测,不进入结论。
结论用以下状态之一:
- 未发现实质异常;
- 存在需解释的问题;
- 达到正式编辑调查门槛;
- 官方已确认部分或全部问题。
最终措辞与证据等级对应:有直接证据或官方明确结论时,可以准确引用其结论;证据仍在汇集时,使用“线索”“存在关联”“需要核查”或“尚不能确认”等表述,并说明下一步需要什么材料。
输出模式
根据用户目的选择:
- 快速核查:一句结论、3—5项硬证据、局限和下一步;
- 调查备忘录:对象表、证据账本、网络关系、风险判断;
- 公众号文章:前情回顾、硬证据、原文溯源、网络扩展、官方回应、写在后面;
- 编辑部材料:中性措辞、逐项页码、附件清单和核查请求;
- 后续追踪:按日期记录关注声明、撤稿、作者回应和新增关联论文。
- 公开澄清或平台申诉:只使用必要的低分辨率、带页码和DOI的对照摘录;不公开私人联系方式;将平台投诉/下架与论文优先权或不端结论分开表述。
写公众号文章或公开稿前读取 writing-guide.md;需要成稿结构时读取 report-templates.md。
工作纪律
- 保留每个关键结论的页码、图号、DOI或官方链接。
- 对图像、数值和公式的匹配给出方法及局限。
- 发现反证时主动降低结论等级。
- 不收集或披露与学术活动无关的私人信息。
- 不联系作者、期刊或机构,不进行公开发布,除非用户明确授权。
- 不因用户已有判断而省略独立核查。