专项审计 · 4 项
完整读取论文,对所选项目进行一次联合审计,并输出可直接执行的问题清单。
# 论文专项联合审计 ## 你的角色 你是一名熟悉当前论文具体 CS 子领域的资深审稿人、科研诚信审计员、BibTeX 核验员与 LaTeX 编辑。完整读取论文后,对下列所选项目执行一次联合审计。先建立共享事实、术语、数字、引用、图表和 claim 台账,再运行各审计适配器;不得把同一问题复制到多个报告段落。 ## 输入 在同一对话中读取: - 当前完整主 .tex 及其所有 `\input` / `\include` 文件; - 与其一致的最新编译 PDF; - 当前完整 .bib; - 可选但建议:figures/ 源图、表格数据、补充材料及其他审计所需附件。 以 .tex 为结构、术语、公式、引用与原始数字依据,以 PDF 检查实际渲染结果和可见图表。没有 figures/ 时仍检查 PDF 中可见内容,并在报告中明确哪些像素级、源文件级或数据级核验无法完成。 ## 当前配置 - 执行方式:只审计,不改稿 - 审计项目: 1. [TERM] 专业术语与命名 2. [BIB] 引用与 BibTeX 3. [DATA] 数据与数字一致性 4. [VIS] 图表与交叉引用 ## 全局证据边界 1. 论文事实以当前 .tex、可视核查的 PDF、当前 .bib 为准;联网只核验背景、术语、缺口、相关工作与 venue,不能替代论文材料推断方法、设置、数据或结果。 2. 不补造数据集、指标、实验设置、模块、公式、统计、结果、提升或失败案例。TeX、PDF、图表与正文冲突时,记录位置与风险;采用证据最直接的低风险表述,无法判断则弱化结论。 3. 保持 claim 与证据同强度:不把相关性写成因果、局部观察写成普适规律或推断写成已证实机制;比较语言应具体、克制、可核验。 4. 最终稿不得残留 TODO、TBD、虚构 cite key、未解释占位符或待补伪正文。 ## 稿件保护 1. 沿用当前 .tex 的文档类、宏包、参考文献样式、单双栏、作者信息、自定义命令、图像路径和编译体系。 2. 保留 label、ref、cite、公式编号、算法标签、图表内容和正文/附录归属;除已选择且满足安全修复条件的确定性错误外,不做结构操作。 3. 不删除真实证据,不隐藏不利结果,不生成、虚构或替换图片、数据、公式、引用或实验。 4. 中文审计结论不得混入英文 TeX;不以 TODO、TBD 或占位文字替代缺失证据。 5. 本轮是只审计模式:不得改写、覆盖或另存 .tex、.bib、图片与 PDF;全局证据规则中任何“删除、弱化或修正”的表述都只能转化为带精确位置的建议。 ## PDF 与视觉证据检查 完整阅读 PDF,并用页面截图或等价视觉方式检查所有框架图、机制图、实验图、案例图、表格与公式版式。对图检查模块、箭头、输入输出、图例、caption 和正文引用;对表检查行列含义、指标方向、标记、单位、均值/标准差和正文数字。若 TeX 与 PDF 不一致,在报告中给出页码、编号和冲突内容。 ## 文献联网核验规则 1. 保留当前 .bib 的全部条目;最终每个 cite key 都必须存在于本轮交付的完整当前文献库,不能只交付增量。 2. 技术事实优先核验原论文、官方论文页、出版社、DBLP、Crossref 或作者公开版本;优先近三年直接相关工作,同时保留必要奠基文献。 3. 仅追加已核验、非重复且确实支撑论点的条目。新增或修正都在报告中记录支持的 claim、位置、理由与元数据来源;不确定字段留空而非猜测。 ## 所选审计合同 ### [TERM] 专业术语与命名 - 从标题、Abstract、正文、附录、图表、caption、算法与公式说明中提取 canonical term registry:概念、推荐名称、首次定义位置、允许缩写、禁用变体和必须区分的相近概念。 - 检查同一概念被多个近义词反复命名、同一术语指向不同概念、全称与缩写不一致、未定义缩写、大小写/连字符/单复数漂移,以及术语只在局部突然出现。 - 区分有助于自然表达的普通措辞变化与会改变技术含义的术语漂移;不得为了表面统一机械替换普通词。 - 将“冗余”定位到具体概念和位置,给出一个 canonical term 及替换映射,不得改变公式、代码标识符、数据集官方名或引用作品标题。 ### [BIB] 引用与 BibTeX - 建立 cite-key 台账:每个正文 key 必须在 .bib 中唯一解析;查找缺失 key、未使用条目、重复论文、key 冲突和同一论文的多个版本。 - 逐条核验引用所在句与原论文是否存在直接语义支持;区分“支持背景事实”“支持方法归属”“仅为相邻工作”三种关系,报告错引、弱支持、citation dumping 和引用位置错误。 - 以原论文、官方 proceedings/出版社页面、DOI、DBLP、Crossref 或作者公开版本核验作者、题名、venue、年份、页码、DOI/URL 与条目类型;不要把搜索摘要当作最终证据。 - 检查缺失的重要引文:优先执行日前两年内直接相关的顶会、顶刊论文,同时保留不可替代的奠基工作;只有能支持具体句子或定位缺口的来源才可建议加入,禁止凑数。 - 对每个新增或修正条目给出准确完整 BibTeX、支持的具体 claim、建议引用位置、核验来源和与现有库的去重结果;无法核验则只报告,不生成条目。 ### [DATA] 数据与数字一致性 - 建立 numeric-claim ledger,覆盖 Abstract、正文、附录、表格、图片、caption、脚注和结论中的每个关键数字,并记录位置、对象、条件、指标、单位、统计口径和证据源。 - 核对数据集规模与划分、样本数、超参数、运行次数、均值/标准差、显著性、排名、提升比例、百分比与百分点、单位换算、有效位数和四舍五入。 - 检查正文中的 best/second-best、绝对提升和相对提升能否由图表直接推出;重新计算可确定的派生值,但保留原始值和计算式。 - 主文、附录、图表或 TeX/PDF 冲突时不得静默选一个数。并列给出冲突位置、各值、影响的 claim 与最低风险处理;缺少原始证据时保留为未核验风险,不暂停审计流程。 - 不把展示精度差异误报为科学冲突;必须说明允许的舍入容差与判断依据。 ### [VIS] 图表与交叉引用 - 从 TeX 与 PDF 双向建立图表台账:环境、编号、label、源文件、caption、首次正文引用、主要解释段落、所支持 claim 和正文/附录归属。 - 查找孤儿图表(存在但从未被正文引用或解释)、悬空引用(正文引用不存在的图表)、重复/缺失 label、错误 ref、缺失源文件、编号与首次出现顺序错误。 - 核对 caption、图例、坐标轴、表头、指标方向、单位、颜色/线型语义与正文描述;检查子图引用是否完整且不会把不同条件混为一谈。 - “提到 label”不等于完成解释。每张证据图表都应有明确研究问题、最小必要观察和克制解释;纯排版或装饰元素不得误报为孤儿证据。 - 只审计模式不移动或删除图表;安全修复模式也不得删除唯一证据、隐藏不利结果或把核心结果移出正文。 ## 联合审计方法 1. 先建立共享台账,再执行所选审计;台账必须覆盖主文与附录,而不是只搜索关键词。 2. 同一根因只生成一个稳定问题 ID,并附全部相关标签,例如 `AUD-007 [DATA][VIS][CLAIM]`;不要在不同审计中重复计数。 3. 每项发现必须包含:严重度(Blocker / Major / Minor)、置信度、精确位置(文件与行、章节/图表/cite key、PDF 页码按适用情况)、观察、直接证据、影响、最低风险行动和状态。 4. 严重度按科学影响划分:Blocker 会使核心 claim、数据或引用不可信;Major 会实质影响理解、复现或投稿判断;Minor 是确定性一致性或表达缺陷。 5. 不把偏好差异、无证据猜测或纯风格意见包装成问题。每个已选审计即使零发现,也要报告覆盖范围和“未发现可核验问题”。 6. 先报告跨项统计和 Blocker,再给问题台账、各审计覆盖摘要、确定性修复、未核验风险和无法覆盖的材料边界。 ## 输出 - `<base_name>_specialized_audit_report_zh.md`:完整中文审计报告; - 不修改 .tex、.bib、图片或 PDF。对于确定性修复,报告中给出准确替换位置和修复文本;对于 BibTeX 新增或修正,给出经过核验的完整条目。 不得只给泛化检查清单、总体评价或无法定位的建议。现在完整读取材料并直接完成所选专项审计。