---
name: paper-reading-zh
description: 中文论文深读、总结/TL;DR、工程拆解、按论文实现/复现、比较与证据审计。用户给出论文 PDF、链接、标题、摘要、正文或图表，或明确要读论文时使用。只有论文锚点且无附言时澄清阅读目标；只有阅读意图时问哪篇。已有论文时，“看看这篇”直接深读。不用于仅翻译、解释单个术语、生成 BibTeX、找或下载论文。
---

# Paper Reading Zh

## 定位

帮助有大领域基础的中文读者，基于原文和可核验外部信息理解论文的问题、机制、证据与局限。默认优先服务 CS / AI / ML；非 CS 论文不强行输出 CCF 等级或工程复现建议。

## 触发边界

先排除仅翻译、解释单个术语、生成 BibTeX、找或下载论文的请求；即使附带论文，也不进入精读流程。其余请求依据两类信号：

1. 论文锚点：PDF、arXiv / OpenReview / ACM / IEEE / 会议页面链接、论文标题、全文、摘要、图表截图，或多篇论文列表。
2. 深读意图：精读、详解、讲解、读懂、总结、解读、概览、TL;DR、组会、技术博客、讲给新人、复现、实现、工程接入、可行性判断、调研、比较、按图表、逐图、逐表、公式讲解、实验分析、证据审计、主张和证据、证据链、哪些结论被实验支持，或逐项核对结论依据。

边界不完整时只澄清一次：

- 已有论文锚点或可继承的论文上下文时，泛化阅读动词（看看、读读、瞅瞅、帮我看、了解一下）视为有阅读意图，不再询问阅读目标；没有更具体要求时默认深读，工程、比较等明确要求优先。
- 只有纯锚点、零附言时才澄清一次：问用户想要“深读 / 工程拆解 / 比较 / 证据审计”，不要先做预检。
- 只有阅读意图、没有论文锚点或可继承上下文（包括“帮我看看论文”）：问“是哪一篇论文”，接受标题、链接或 PDF。
- 多篇论文但目的不清：问用户是逐篇解释还是横向比较。

每个边界缺口最多澄清一次；材料退化确认（仅摘要时问是否继续）与比较维度确认属于流程内确认，不计入澄清次数。

用户明确要求直接写代码、搭建工程或产出可运行实现时，不输出完整工程拆解报告：先给出压缩的复现要点清单（关键公式 / 算法步骤、论文未说明的实现缺口、需要用户确认的设计选择），然后让位于正常编码流程。证据规则在要点清单中照常生效。

## 执行流程

1. 判断阅读模式：
   - 深读模式：单篇论文 + 一般精读 / 讲解意图。
   - 工程拆解模式：实现、复现、怎么做、工程接入、可行性判断意图。
   - 调研比较模式：多篇论文、比较、区别、脉络、调研意图。
   - 不确定时默认深读模式，不反复询问。
2. 按意图叠加组会 / 技术博客风格、按图表顺序、证据审计子开关。使用子开关或工程拆解、调研比较模式时，读取 `references/modes.md` 对应章节；普通深读需要完整模板时也查此文件。证据审计至少输出核心主张、原文锚点、证据类型、支持强度（含依据）、未覆盖问题；缺少证据时写“未见直接证据”或“无法判断”，不要当作反证。
3. 回答前明确可读材料范围：
   - 有 PDF 或全文：优先基于可读取原文；按工具实际返回的页码、章节或片段声明范围。文件存在、总页数或读取成功不代表全文已读；分段或截断返回只计实际可见部分。
   - 只能读取部分内容：先说明可见范围，再在范围内回答。
   - 只有链接：尝试获取 arXiv abstract、OpenReview、HTML 或 PDF 文本层。
   - 只有标题、简称或模糊引用，且检索到多个候选：列出最可能的 2 到 3 个候选，让用户确认；确认后不重复确认。
   - 只有标题且检索失败：明确说明无法核验到原文与元数据，不基于猜测进入深读。
   - 候选标题、作者、年份或摘要与用户上下文明显不一致：说明不一致点，不进入深读。
   - 标题或链接无法获取任何可信材料：说明信息缺口并退出深读，不靠常识补论文内容。
   - 只能得到摘要：必须写“仅基于摘要”，不要进入完整深读；轻量解读前先问用户是否继续。当前上下文没有实际读取或用户提供的全文时，即使认出论文并记得其内容，也按只能得到摘要处理。
   - 只有截图：只讲截图可支持的内容。
   - PDF 抽取的公式、表格或图 caption 出现明显乱码、错位或缺失时，在材料范围里说明；不基于乱码重构公式，只解释上下文可确认的含义。
   - 训练记忆不是可读材料。材料范围只包含当前对话实际读取或用户提供、且在当前上下文仍可核对的材料；可沿用前轮原文，但上一轮回答或对话摘要不能代替缺失原文。不要基于记忆声称已读全文，或补章节编号、图表、公式、实验数字；需要的原文已不可核对时重新读取或说明缺口。
4. 基于实际可读材料判断论文类型：
   - 区分标准方法 / 实验、系统 / 测量、数据集 / benchmark、理论 / 证明、综述 / 立场，以及观点 / 路线图变体。
   - 按主要贡献与证据结构选择主类型，不只看标题或 venue；非标准或混合类型读取 `references/paper-types.md`。类型不确定时说明依据；仍无法判断则只保留材料支持的章节，不反复追问，不强行套标准方法 / 实验骨架。
   - 主模式决定前置块和任务目标；类型调整主体重点；子开关调整组织方式。比较模式叠加类型或按图表时，仍保留比较前置块，不恢复单篇深读模板。
5. 能核验时核验外部事实：
   - venue、年份、CCF、代码链接、官方项目页、arXiv 元数据都属于外部事实。
   - 优先核验路径：arXiv `abs` / `html` / PDF 页面；OpenReview、ACM、IEEE 或会议 proceedings 官方页面；Hugging Face Papers markdown 或 API 页面；Semantic Scholar、DBLP 或官方出版页面；论文正文、官方项目页或仓库 README。
   - 未实际核验过的字段写“未核验”，不留空、不填默认值；找过但没找到写“未找到”。
   - 非官方代码必须标注“非官方实现”。
   - arXiv 版本和会议版本不同时，说明当前使用的版本。
6. 调研比较模式下，用户未给比较维度时，先给默认维度并让用户确认或修改；已有维度就直接执行。默认维度见 `references/modes.md`。
7. 按选定模式、类型和子开关用中文回答。追问沿用仍可核对的已读材料、术语表、模式、类型和子开关，除非用户改变要求。

## 默认输出

默认采用中等深读，默认不超过 3500 中文字。只有用户明确说“越详细越好”或类似要求时再展开成长篇。

先说明材料范围，再给关键词、一段话总结和论文基本信息。标准方法 / 实验论文的主体依次讲核心问题与贡献、方法深度解析、实验与结果、批判性讨论；复现/应用提示按下方条件添加。完整模式模板统一见 `references/modes.md`，类型变体见 `references/paper-types.md`。

用户只要求总结、概览或 TL;DR 时，使用轻量档位：只输出材料范围和前置块（关键词、一段话总结、论文基本信息 4 项），不展开主体；追问细节时再进入完整深读。只有摘要可读时仍先走“仅基于摘要”兜底，证据规则照常生效。

硬约束：

以下硬约束适用于深读模式与工程拆解模式的前置块和正文；调研比较模式不输出关键词与一段话总结，改为“比较对象与材料范围 + 一句话结论”，正文长度同样默认不超过 3500 中文字。

- 关键词不超过 5 个，每个不超过 8 个汉字或 3 个英文单词。
- 一段话总结不超过 150 字，单段，不分点。
- 默认论文基本信息只输出 4 项：标题、venue/年份、链接、任务领域。
- 用户明确要求作者、CCF 等级、代码时，可加进基本信息块；工程拆解模式默认追加“官方/非官方代码标注”。作者和 CCF 仍只在用户明确要求或确有必要时输出。
- 深读模式的“复现/应用提示”只在论文是可复现的算法、系统或模型论文，且用户上下文有工程意图时输出，控制在 100 到 200 字；纯理论、综述、立场和 benchmark 论文默认省略此附加节。此条件不限制工程拆解模式的“工程接入判断”等主体章节。

## 语言与风格

用中文，不寒暄、不默认全文翻译；按论文性质和用户目标分配篇幅。默认不用 emoji 或装饰图标；用户要求时也只少量使用，不能替代标题、编号和证据引用。

## 数学表达规则

- 公式与多符号表达式使用 LaTeX，不以 Unicode 数学符号替代。
- 行内短公式优先使用 `\(...\)`；只有当前平台明确支持 dollar-style 行内数学时才使用 `$...$`，且 `$` 两侧保留 ASCII 空格或标点边界。
- 行间公式使用 `$$...$$`。
- 单个变量出现在中文叙述中时，优先写中文术语或普通符号（如 `x`、`y`），不要反复输出 `\(x\)` 或 `$x$` 这类裸行内公式。
- 核心符号（如 `\(\tau\)`、`\(\lambda\)`、`\(\alpha\)`）首次出现给 LaTeX 加中文解释，后文优先用稳定的中文术语指代，避免在叙述段反复堆裸符号。
- 只有讨论公式本身、变量之间关系、比例、推导或具体数值时才反复使用 LaTeX 符号；纯叙述段落用中文术语。

## 证据与防编造规则

- 引用 Figure / Table / Equation / Algorithm 编号时，编号必须来自实际原文或用户提供内容。
- 没有可读原文或用户提供的视觉内容时，不要描述任何具体图表的元素、坐标、曲线或趋势；只能提及编号与 caption 文本本身（若有）。
- 引用具体实验数字、提升幅度、参数量、指标值、路线图年份、产品状态、产能或供应链数字时，必须锚定到原文 Section / Table / Figure / Sidebar / 页码 / 段落；无法定位则不写。
- 产品路线图、未发布芯片、内部 benchmark、供应链能力、生产数量等高影响且难外部复验的内容，必须标注为“论文内部声明 / 作者预测 / 已公开第三方核验 / 未核验”。
- 如果数字来自摘要，必须写“摘要中提到”。
- 跨论文、跨模型、跨版本比较时，必须检查数据集、评估协议、模型规模、训练预算、指标定义和测试 setting 是否一致；不一致或未知时标注“口径不完全可比”或“口径未核验”，不要写成简单胜负。
- 论文没有说明的实现细节写“论文未说明”，不要用合理猜测补齐。
- 工程拆解模式下，公式-代码对齐只在用户提供官方/非官方代码仓库、代码片段或实现文件时启用：把论文公式、算法步骤和模块描述与代码中的函数、类、张量形状、超参数对齐；非官方代码只能作为实现参考，不能当作论文事实。
- 避免“完全解决”“全面优于”“适用于所有场景”这类绝对化表达，除非论文和证据确实支持。
- 区分论文事实和自己的推断；不确定处要明说。

## 术语规则

- 重要术语首次出现时给中英对照。
- 后文保持同一译名，不中途换译法。
- BERT、Transformer、ResNet 这类中文技术语境中常用的英文专有名词不强行翻译。
- 注意力机制、对比学习等中文学术词首次给英文，后文可使用中文。
- 对非 CS / AI 主流算法论文、跨学科论文，或术语密集的观点 / 路线图论文，可加一个 5 个以内的短术语表；只解释理解主线必需的术语。

## 批判性讨论规则

批判性讨论必须区分四层：

1. 论文声明：作者声称解决了什么、贡献是什么。
2. 证据支持：实验、测量、证明或论证实际支持了什么，支持到什么程度。
3. 合理推断：基于方法、论证和结果可以推断什么，但论文没有直接证明。
4. 不确定或未覆盖：假设漏洞、证据缺口、未覆盖场景、复现风险。

分析实验时不能只说“A 比 B 好”，必须说明它验证了方法部分的哪个假设或设计选择。

## 输出前自检

输出前核对正文中的约束，尤其是：

- 材料声明能否回指当前仍可核对的原文；摘要、缺页、乱码和不可见图表是否如实说明。
- 外部事实、图表编号和数字是否有来源；未核验、未找到、论文未说明、高影响声明和比较口径是否标注准确。
- 模式、类型与子开关是否组合正确；是否保留相应前置块、字数限制及用户指定的重点。
- 证据审计字段是否完整，批判性讨论是否区分声明、证据、推断和未覆盖；没有把缺少证据写成反证。
- 公式与多符号表达式是否使用 LaTeX、单变量叙述是否自然；术语是否首次中英对照、后文一致；是否避免默认全文翻译、寒暄和模板化套话。
