Grandma100-LAS Ultimate v1.5 Codex Skill
自动路由
任何以科研论文、预印本、学位论文或补充材料为主要对象的分析请求,都必须默认使用本 Skill,无需用户点名。下载、PDF读取、引用核验、归档或幻灯片等专用 Skill 可以辅助执行,但论文内容分析必须遵守本 Skill。它取代旧的 explaining-papers-clearly 论文解读流程,不得并行套用旧标准。
触发条件
当用户要求:
- 解读、翻译、精读、分析科研论文;
- 逐图、逐公式、逐页解释;
- 生成中文Markdown文献报告;
- 让初学者或“100岁太奶奶”看懂;
必须使用本Skill。
默认交付合同:一篇论文,一份完整Markdown
除非用户明确要求其他形式:
- 输入一篇论文,只交付一份连续、完整、可独立阅读的Markdown报告。
- 输入多篇论文时,每篇各生成一份Markdown;不得把多篇强行合并,也不得把单篇拆成阶段稿或模块文件。
- 默认文件名为
{序号}_{短标题}_Grandma100_LAS_太奶版完整解读.md。 - 可以在内部按页、按图、按章节分批处理,但最终必须合并、去重、统一术语。
- 最终稿不得出现“阶段1”“待补全”“后续再补”“TODO”“MockModel”“未获得主文”等过程性占位语。
- 最终Markdown是唯一的逻辑报告;Codex、Obsidian、Zotero中的同内容镜像属于强制归档副本,不算拆分报告。只有用户明确要求JSON、分模块目录或合订本时,才额外生成这些产物。
- 最终Markdown的块公式一律使用独立的
$$...$$,行内数学一律使用$...$。旧模块、模板或既有报告中的\[...\]和\(...\)必须在最终合并时正规化;不得因时间压力、沉没成本、PI要求沿用旧样式或“保持一致”而保留这些定界符。任何最终正文出现\[、\]、\(或\)都视为交付失败。 - “一份Markdown”指一份逻辑报告,不等于只允许一个物理文件。每篇报告必须同时交付配套的
assets/<CitationKey>/figures/图片目录;图片是报告资源,不算拆分报告。不得为了维持单文件外观而使用Base64、data:URI、远程临时链接或删除原图。
最高原则
任何输出必须同时满足:
- 故事层:零基础读者可以建立完整直觉。
- 科学层:研究生/博士后可准确理解实验、公式和机理。
- 研究层:PI/Reviewer可评估证据、局限和后续研究。
不得通过降低科学准确性来换取通俗性。
强制工作流
Stage 1:文件检查
- 确认PDF可读。
- 提取标题、作者、期刊、年份、DOI、摘要、目录。
- 统计页数、Figure、Table、Equation、Supporting Information。
- 建立覆盖台账:
总数 / 已覆盖 / 无法核验 / 缺失,最终报告内必须保留这张对账表。 - 若图像无法从文本确认,必须渲染页面查看,禁止猜图。
- 为正文和可得SI中的每个Figure建立图片资产台账:
Figure编号 / PDF页码 / 整图文件 / 子图文件 / 已嵌入位置 / 状态。 - SI未随主文提供时,先检查本地附件、DOI落地页、期刊附件页和作者公开仓储;仍不可得才标记缺失,并说明已检查位置。
Stage 2:预读
输出:
- 一句话总结
- 五分钟故事版
- 研究问题
- 论文逻辑链
- 历史位置
- 与上下篇文献衔接
Stage 3:逐页解析
每页必须包含:
- 页面定位
- 中文翻译
- 一句话总结
- 逐段解释
- 新术语
- 与前后页的逻辑关系
- 证据与局限
- 太奶奶总结
长篇综述允许用“逐页紧凑地图+按主题深讲”减少重复。紧凑地图的每一页至少必须写出:页码、所属章节、本页任务或核心观点、本页证据对象(图/表/公式/实验/无)以及与全文主线的关系;关键定义、证据、图表、公式和转折段仍须按上述8项展开,不得只用页码加一句主题冒充覆盖。
Stage 4:逐图解析
4.1 原图截图与Markdown就地嵌入合同
- 正文和可得SI中的每个Figure都必须从用户提供的原始PDF渲染或提取为PNG,并在该Figure解读标题之后、文字解释之前就地嵌入。不得只给图号、页码、占位符或让读者自行对照PDF。
- 优先保留完整Figure,包括子图编号、坐标轴、图例、颜色、箭头、比例尺和必要标签;只有整图中文字不可读或需要逐子图讲解时,才额外裁出子图。不得裁掉理解结论所需的图例、坐标或比例尺。
- 默认以200–300 dpi导出PNG;显微图、谱图或小字号标签以实际清晰可读为准,可以提高分辨率,但不得插值、重绘、修饰或改变原始数据含义。
- 图片统一放在相对报告位置
assets/<CitationKey>/figures/。命名为Fig01_full.png、Fig01a.png、FigS01_full.png;无法可靠裁图时使用Fig03_page12.png保存对应PDF整页截图。 - Markdown固定使用可移植相对路径,例如:
。每张图的替代文本必须含Figure编号、简短内容和来源页码。 - Figure过宽或过长时先嵌入整图,再按讲解顺序嵌入必要子图。图注在图片下方给出中文翻译与来源定位,不把原图截图当作文字解读的替代品。
- 表格默认重建为Markdown表格;只有布局、脚注、颜色或图形单元格无法忠实重建时,才同时插入原表截图。
- 若无法可靠裁出Figure,必须插入包含它的完整PDF页面截图并说明Figure位置。若页面也无法渲染,则标记“图像未能提取,未进行视觉推断”,只解释正文和图注可核验内容;该Figure记入
无法核验,不得通过最终认证。 - 禁止使用Base64、
data:URI、绝对本地路径、仅本机有效的临时路径、远程临时URL或空白占位图。交付前必须逐一解析Markdown图片链接并验证目标文件存在、可读且非零字节。
每个Figure及子图必须回答:
- 图是什么?
- 为什么做?
- 颜色、坐标、箭头、比例尺分别是什么?
- 原始数据如何得到?
- 作者想证明什么?
- 图是否真的支持结论?
- 有哪些替代解释和伪影?
- 证据强度★★★★★
- Reviewer与PI怎么看?
Stage 5:公式解析
每个正文Equation、可得SI中的Equation,以及所有参与结论、拟合、统计或数据换算的公式都必须解释:
- 原式
- 公式来源
- 每个变量
- 每个单位
- 推导思路
- 物理意义
- 极限情况
- 适用条件
- 失效条件
- 在本文中的具体作用
- 生活化例子
Markdown数学公式兼容合同
最终Markdown中的数学内容统一采用MarkText、Obsidian及常见MathJax/KaTeX阅读器可识别的美元符号定界格式:
- 块级公式固定写成独立的
$$、公式正文、独立的$$,两个定界行前后各留一个空行。 - 行内数学变量或表达式固定写成
$...$,例如$Q_{\mathrm{H}}$、$j_k$和$E=mc^2$。 - 不使用
\[...\]、\(...\)作为Markdown公式定界符;不把数学变量写成反引号代码,也不生成`$j_k$`这类“美元符号套反引号”的混合格式。 - 反引号只用于非数学字面量:文件路径、文件名、命令、配置键、状态值和程序代码。不得把这些内容误改为数学公式。
- 交付前扫描完整Markdown字符串,范围包括标题、正文、列表和表格:把所有
\(...\)改为$...$,把所有\[...\]改为独立的$$...$$。若仍存在\[、\]、\(、\)公式定界符,或数学变量仍被反引号包围,则格式检查失败,必须修正后再交付和归档。 - 输入模块使用其他定界符时,合并步骤必须转换为本合同格式;输入样式不是豁免条件。
- 成品中允许充当数学定界符的只有
$和$$;标题里的变量同样写成$...$,不得使用LaTeX原生的\(...\)。
标准形状:
反应速率常数为 $k$,活化能为 $E_a$。
$$
k=A\exp\left(-\frac{E_a}{RT}\right)
$$
原始PDF路径为 `F:\Paper\example.pdf`。
Stage 6:实验解析
每个实验必须说明:
- 实验目的
- 原理
- 装置
- 样品和条件
- 操作流程
- 数据处理
- 能证明什么
- 不能证明什么
- 常见误区
- 替代方法
- Reviewer可能要求的补充实验
Stage 7:DFT/理论解析
若论文包含DFT、MD、AIMD、NEB、微观动力学:
- 模型构建
- 超胞、slab、真空层、k点、截断能、泛函、U值、自旋
- 吸附能/自由能
- DOS/PDOS
- 电荷密度/Bader/COHP
- NEB/AIMD
- 结构→电子结构→吸附→性能因果链
- 模型假设、误差和不可外推之处
Stage 8:历史与参考网络
- 建立关键技术时间轴。
- 解释关键参考文献为何被引用。
- 区分奠基工作、方法学工作、竞争工作和后续发展。
- 论文之外的历史或后续发展必须给出可核验来源,并明确标记为【通用背景】;无法核验时不写成事实。
Stage 9:批判性评审
建立Claim–Evidence表:
- Claim
- Evidence
- Evidence strength
- Alternative explanation
- Potential artifact
- Missing experiment
- Reviewer decision
Stage 10:用户科研关联
仅在用户背景已知且与论文有关时输出;不相关或背景不足时写明“不适用”,禁止牵强类比:
- 与SMSI联系
- 与Ru-Co/TiO2联系
- 与HOR/HER/ORR联系
- 与Operando联系
- 与单颗粒/单分子联系
- 可迁移实验
- 可检验新假设
- 不可直接类比之处
Stage 11:最终交付
最终单一Markdown至少包含:
- 基本信息、实际读取范围与缺失附件说明
- 中文题目与摘要逐句翻译
- 五分钟故事版、阅读前术语表、科学问题与逻辑链
- 全文逐页或逐章节地图;长综述可用紧凑页码表加主题深讲
- 正文和可得补充信息中的全部图、子图、表格及图中标签解读;每个可得Figure的原图截图已在对应解读处就地嵌入,图片链接可解析
- 正文与可得SI中的全部Equation,以及所有数据换算、拟合和统计公式:原式、中文口述、符号、单位、来源、示例、意义和边界
- 实验、数据处理、误差、拟合、统计和复现条件
- 理论或DFT;论文没有时明确写明“不适用”
- 关键定量结论及其页码、图、表或公式证据位置
- 覆盖对账表:页、图、子图、表、公式、实验、SI的总数、已覆盖数与缺失数
- Claim–Evidence表、替代解释、Reviewer/PI视角和局限
- 应用价值、用户研究关联及不可直接类比之处
- 太奶FAQ、中英术语表、记忆卡、五句话总结和最终总结
完整度由覆盖和证据决定,不由字数决定。常规研究论文的完整太奶版报告通常不会短于约15 KB中文Markdown;短于此值时必须复查是否漏了图、公式、方法或证据边界,但不得为凑长度重复改写。
Stage 12:三库强制归档
最终报告通过内容门槛后,把用户给出的原始论文PDF、最终完整Markdown报告和配套图片资产存入Codex、Obsidian、Zotero三个文献库。三库各保留PDF与Markdown两个核心实体,共六个核心归档对象;图片目录或图片包是必须随行的附加资产。复制而不移动源文件。
REQUIRED SUB-SKILL: Use paper-library-archiver for Codex literature-library archival.
REQUIRED SUB-SKILL: Use obsidian-literature-workflow for Obsidian archival.
REQUIRED SUB-SKILL: Use zotero:Zotero for Zotero readiness, deduplication, target selection and write verification.
12.1 统一身份与写前检查
- 生成统一
CitationKey,优先格式为FirstAuthorYYYYShortTopic;三库、PDF、Markdown、图片目录和最终回执使用同一Key。 - 按
DOI → 规范化标题+年份 → CitationKey查重。已有同一论文时先读取再合并,不重复建卡、条目或源笔记。 - PDF归档名固定为
<CitationKey>.pdf;Markdown在Codex中沿用既有文章卡命名<CitationKey>.md,在Obsidian和Zotero中使用<CitationKey>_Grandma100_LAS_太奶版完整解读.md。重命名不得改变文件内容。 - 写入前验证PDF文件头为
%PDF,计算源PDF、最终Markdown和每个图片资产的SHA-256与字节数;图片数必须与Figure图片资产台账一致。 - 已有目标文件与源哈希相同则复用;哈希不同时不得静默覆盖,保留旧版并用日期时间后缀保存新版,同时在回执中说明冲突处理。
12.2 Codex文献库
- 用户指定库时使用指定路径;否则使用
paper-library-archiver的默认库。 - PDF存为
pdfs/<CitationKey>.pdf。 - 最终完整报告存为
article_cards/<CitationKey>.md;该文章卡本身就是通过门槛的完整报告,不得用短摘要或索引替代。 - 图片存为
article_cards/assets/<CitationKey>/figures/*.png;报告中的图片相对路径必须从article_cards/<CitationKey>.md实际解析到这些文件。 - 按
paper-library-archiver现行规范更新题录、BibTeX、分类、索引和PDF状态;这些辅助记录不替代上述两个实体文件。
12.3 Obsidian文献库
- 用户指定Vault时使用指定Vault;否则读取Obsidian应用配置中的已打开/最近使用Vault,再检查当前项目及父目录中的
.obsidian。无法唯一定位时标记阻塞,不私自新建或猜测Vault。 - PDF存为
Attachments/Papers/<CitationKey>.pdf。 - 最终完整报告存为
Sources/Papers/<CitationKey>_Grandma100_LAS_太奶版完整解读.md;不得只写链接、摘要或占位源笔记。 - 图片存为
Sources/Papers/assets/<CitationKey>/figures/*.png;报告使用相对路径,复制或移动整个Sources/Papers结构后仍须可显示。 - 报告中的PDF链接必须指向实际附件;可复用主张继续遵守
Sources/Papers/ → Knowledge/ → Writing/ → Maps/literature.canvas证据门禁。
12.4 Zotero文献库
- 先探测Zotero Desktop、本地API/Connector或可写Zotero工具;按DOI、标题和年份查重,复用或创建唯一父文献条目。
- 用户指定collection时使用指定collection;否则使用当前选中collection;仍无目标时复用或创建
Grandma100-LAScollection。 - 在父条目下创建两个独立的存储型子附件:
<CitationKey>.pdf与<CitationKey>_Grandma100_LAS_太奶版完整解读.md。 - 另创建
<CitationKey>_Grandma100_LAS_assets.zip存储型子附件;ZIP内必须包含与Markdown相对路径一致的assets/<CitationKey>/figures/目录及全部PNG。Zotero中的独立Markdown预览不保证解析压缩包内图片,完整图文阅读以解压后的便携报告包为准。 - Zotero note、网页快照、外部路径链接或仅有BibTeX/RIS元数据都不能冒充这两个文件附件。
- Zotero本地API是只读接口;只支持题录导入而不能创建本地存储型附件时,必须把Zotero标记为阻塞。禁止直接修改
zotero.sqlite,也禁止声称已归档。
12.5 写后回读、六核心对象与图片资产台账
归档后重新读取并核验:
| 文献库 | PDF成功判据 | Markdown成功判据 | 图片资产成功判据 |
|---|---|---|---|
| Codex | 文件存在、可读、%PDF、SHA-256与源PDF一致 |
文件存在、可读、SHA-256与最终报告一致 | 全部相对图片链接可解析,PNG数量、字节数和SHA-256与源资产一致 |
| Obsidian | Vault内实体文件存在、SHA-256一致、报告链接可解析 | Sources/Papers中实体文件存在、SHA-256一致 |
全部相对图片链接可解析,PNG数量、字节数和SHA-256与源资产一致 |
| Zotero | 父条目下存在可回读的PDF存储型附件,记录attachment key、文件名和字节数;可读文件时再核对SHA-256 | 父条目下存在可回读的MD存储型附件,记录attachment key、文件名和字节数;可读文件时再核对SHA-256 | 父条目下存在可回读的assets ZIP存储型附件;ZIP文件清单、PNG数量和SHA-256与源资产一致 |
最终回执必须包含:论文题目、DOI、CitationKey、PDF与Markdown源路径及SHA-256、图片数量与资产目录、六个核心对象的实际路径或Zotero key、三库图片资产路径或ZIP attachment key、各自验证状态、去重/冲突处理、总体状态、阻塞原因和所需用户动作。
12.6 状态语义
内容状态与归档状态分开记录;归档失败不篡改论文解读质量评分。- 六个核心对象及三库图片资产全部写入并回读成功:
archive_overall_status: complete。 - 任一核心对象或图片资产未验证:
archive_overall_status: partial或blocked,不得说“三库归档完成”或“最终任务完成”。 - 某库受阻时,已明确定位的其他库仍可完成;保留最终报告并给出精确阻塞项,不用假成功掩盖外部条件不足。
- 多论文批次按每篇各自维护六核心对象与图片资产台账;只有每篇全部通过,才能声明整个批次三库归档完成。
禁止事项
- 禁止只翻译不解释。
- 禁止杜撰数字、图号、实验条件和作者结论。
- 禁止把推断写成事实。
- 禁止遗漏任何正文Figure/Table/Equation。
- 禁止只写Figure解释却不在对应位置嵌入原图截图;禁止用Base64、临时URL、绝对本地路径或图片占位符冒充可移植图片资产。
- 禁止使用大量碎片化短句制造“通俗感”。
- 禁止只写优点、不写局限。
- 禁止只说“与用户研究有关”,必须给出具体机制和实验迁移方案。
- 禁止因篇幅长而自行停止;可以在内部拆批处理,但交付前必须合并为一份完整报告。
- 禁止未经用户要求输出阶段稿、附加进度文件、模块目录或跨论文合订本。
- 禁止用“核心公式”作借口漏掉正文Equation、数据换算式、拟合式或统计式。
完成门槛
只有同时满足下列要求,才能写“最终版完成”:
- 全文覆盖
- 图表覆盖
- 每个可得Figure的原图截图已在对应解读位置就地嵌入,全部相对图片链接有效
- 公式覆盖
- 实验覆盖
- 理论覆盖
- 历史覆盖
- Reviewer覆盖
- 用户科研联系覆盖
- 术语表、FAQ、记忆卡和最终总结完成
- 覆盖对账表中所有可得项目均已覆盖;无法核验项已说明原因
- 一篇论文最终只有一份逻辑Markdown报告和一个配套图片资产目录;图片资产不算拆分报告
- 原始PDF与最终Markdown已在Codex、Obsidian、Zotero形成六个可回读核心实体,图片资产也已在三库回读验证;任何未验证项已按
partial或blocked报告 - 最终稿无阶段标记、占位符、内部流程说明或重复拼接痕迹
- Markdown数学格式检查通过:块公式只用
$$...$$,行内数学只用$...$,非数学路径、命令与代码继续使用反引号 - 无已知杜撰
- Quality Score ≥ 95
Quality Score按以下满分100计:中文翻译12、太奶可懂性12、页面/章节覆盖12、图表18、公式12、实验与数据10、理论6、证据边界10、FAQ/术语/记忆5、单文件与追溯3。评分和证据位置必须写入同一报告末尾的简短自检表。
认证前提:中文翻译、页面/章节、图表、公式、实验与数据、适用的理论、证据边界、单报告与追溯八个强制维度必须各得满分;95分容差只能来自太奶可懂性或FAQ/记忆辅助。任一Stage 3–7必答字段缺失、可得Figure未嵌入原图、图片链接失效、覆盖台账未清零、任何杜撰、事实推断混写、阶段占位或未经要求拆分逻辑报告,均一票否决,不得用总分抵消。
若补充信息、原始数据或关键图页缺失,可以交付“基于现有主文的完整解读”,但不得标记“最终版完成”或“Grandma100 Certified”;必须写明“主文解读完成;证据包不完整,未认证”,不得假装全部证据已经核验。
多论文批次只有在每篇各自通过门槛后才能声明整个批次完成。允许先交付已经完成的单篇文件,但必须准确说明批次尚有多少篇未完成;不得生成阶段稿或用部分完成冒充全部完成。
Grandma100 Certified只表示内容质量门槛通过;archive_overall_status: complete表示六核心对象和图片资产归档通过。只有两者同时通过,才能声明该论文的Grandma100任务最终完成。