@lijigang/ljg-paper-river
Paper reader for non-academics. Takes a paper and extracts its ideas for personal use. Focuses on understanding, not academic critique. Use when user shares an arxiv link, paper URL, PDF, or asks to analyze a research paper. Trigger words: '读论文', '分析论文', 'paper', or when user shares an academic paper.
| name | ljg-paper |
| description | Paper reader for non-academics. Finds the load-bearing concepts the reader does not yet truly have, rebuilds them through relations and cases, and turns one paper into a bounded model that explains a concrete phenomenon. USE WHEN the user shares an arXiv link OR paper URL OR PDF OR local paper file OR paper title, or asks to read, explain, analyze, or understand a paper. Defaults to a saved org note. NOT FOR experiment reproduction, exhaustive method summaries, formal peer review, benchmark tables, or literature surveys. |
ljg-paper:把陌生概念长成解释模型
让一个不懂该领域、但愿意思考的人,不只知道论文说了什么,还能指出自己原先缺少哪些概念、这些概念怎样共同生成现象,以及什么条件变化会让模型失效。
全文仍只服务于一个中心命题,但中心命题只是脊柱,不是理解本身。抵达它之前,不能把承重概念压缩掉;抵达它之后,必须把概念接成一个能运行、能解释、能受证据约束的模型。
理解契约
「见过术语」不等于「已经有这个概念」。若读者不能完成下面任一件事,就把它记入概念缺口:
- 用普通话指出它区分了什么,以及它不是什么;
- 说明它依赖什么、影响什么,和相邻概念怎样连接;
- 在论文案例中认出它,并判断一个反例或边界案例为何不同;
前三项检验单个概念是否形成;概念接成模型后,再检验关键条件变化时现象会怎样变化。概念缺口不是术语表。只记录中心命题、机制和证据链上的全部承重概念;外围术语按需解释,不让清单淹没论文思想。
Workflow Routing
| 输入 | 必读 | 输出 |
|---|---|---|
| arXiv、PDF、paper URL、本地论文 | ReadingGuide.md |
按四段结构生成 org 笔记 |
| 只有论文标题 | 找到可靠原文后读 ReadingGuide.md |
按四段结构生成 org 笔记 |
| 用户明确只要口头解释 | ReadingGuide.md |
不写文件,按同一理解路径讲 |
写 org 文件时再读 references/template.org。默认保存到 ~/Documents/notes/。
文件名沿用 Denote:{YYYYMMDDTHHMMSS}--paper-{方法名或论文关键词}__paper.org;时间戳用 date +%Y%m%dT%H%M%S 生成。
Gotchas
#+source是 meta-info,不是参考资料列表。 只保留一个最接近论文原文的规范 URL,直接写裸 URL;不加链接描述,不并列摘要页、PDF 页或其他入口。- 压出中心命题太早,会把未知概念藏进一句漂亮话。 先写暂定命题,再扫描其中每个承重词;概念补齐后必须重写命题。
- 熟悉感最容易冒充理解。 能翻译术语、复述定义或举一个相似例子,都不等于拥有概念;单个概念要经得起区别、关系和案例检查,整体模型还要经得起条件变化检查。
- 概念清单也会制造碎片。 不按论文出现顺序或字母顺序罗列;按依赖关系补概念,并立刻接回同一个现象。
- 定义不是概念。 每个概念都要在至少一条关系和一个具体案例中工作;孤立释义默认删除。
- 模型不是流程图的别名。 它必须解释原锚点、区分一个邻近情况,并对条件变化给出有方向的预测。
- 并非每篇论文都在反对旧观念。 评测、数据集和工具论文常常只是暴露旧尺子的盲点;不要硬造稻草人。
- 评测贡献不等于科学发现。 新 benchmark 让某个问题变得可测,不等于解释了现实世界。
- 证据和适用范围必须贴着主张。 独立实验摘要和独立免责声明都会切断它们与洞见的关系。
- 不要默认 prose 就是最清楚的解释。 架构、因果链、分布、权衡和状态变化若难以在脑中成形,应让关系直接显形。
- 图也会夸大论文。 图必须与它所解释的证据和边界相邻;不能把「在这些条件下显示」画成普遍规律。
- 不要把公式删除当成通俗。 若一个关系式就是核心洞见的最短表达,保留一个最小公式并立刻翻译成人话;应删除的是未解释的公式堆。
- 启发不是应用清单。 优先只留一个判断问题,最多展开两个真正相关的用法。
- 允许思想含量有限。 工程增量就说是工程增量;没有直接用途时不要硬编。
概念缺口到解释模型
先围绕暂定中心命题建立内部的「概念缺口账本」。对每个承重概念写下:它区分什么、它与谁发生什么关系、论文中哪个案例让它可见。按依赖顺序补:先补后续概念所依赖的,再补论文新增或改写的。
成文时,在「它真正看见了什么」中保留全部尚需补齐的承重概念,但按关系链推进:概念只在模型需要它的那一刻出现,并立刻回到案例。不要给每个概念分配一张卡或一个固定段落;全文合起来完成所有概念的「区别 + 关系 + 案例」,也不输出已经熟悉且不承重的词。
概念补齐后,把它们接成最小解释模型:
条件/输入 -> 概念之间的作用关系 -> 首个可观察变化 -> 现象/结果
模型至少接受三次检查:
- 回到原现象:能解释贯穿全文的具体锚点,而不只是换词复述;
- 区分邻近情况:能说明一个看似相同的案例为何会有不同结果;
- 改变一个条件:能预测某个概念变强、变弱或缺席时,首先会观察到什么变化。
随后找出最大的剩余阻力:读者可能仍无法在脑中形成关系,也可能无法判断证据究竟支持模型到哪一步。选择理解成本最低的表征,不要默认继续写 prose。
| 论文中的思想形状 | 优先表征 |
|---|---|
| 模型架构、数据流、模块关系 | 结构图或流程图 |
| 因果链、训练过程、状态变化 | 因果图或时间轴 |
| 反馈、迭代更新、自我强化 | 回路图 |
| 分布、尺度效应、边际变化 | ASCII 曲线 |
| 准确率与成本、速度与质量 | trade-off 曲线 |
| 旧指标与新指标反复对照 | 小表格或二维矩阵 |
| 一个案例如何逐步变化 | 对齐的 example trace |
| 公式就是不可替代的核心关系 | 一个最小公式,加人话翻译 |
| 两三句话已经足够 | 纯文字 |
图不是标配。它只在降低理解成本时出现,并放在概念已经用人话和案例落地之后;图负责让关系显形,不替代概念形成。相关证据和适用边界紧随其后。ASCII 图使用 org 的 #+begin_example / #+end_example 块,宽度不超过 80 字符。
判断图是否有用,不只看它能否复述模型,还要看它是否守住证据分寸:读者只看图,应能说出哪些概念在怎样作用、论文改变了什么判断,但不会得到超出实验支持的结论。若图只是把摘要换行,删除它。
Quick Reference
- 判主类型:解释、方法、测量、资源或理论。
- 选一个外行能看见的具体困惑,贯穿全文。
- 写暂定命题脊柱:「面对什么;看见什么;以后怎么判断。」
- 扫描命题、机制和证据链,记下全部承重的概念缺口。
- 按依赖顺序,用区别、关系和案例补齐概念,再重写中心命题。
- 把概念接成能解释锚点、区分邻近情况并预测条件变化的最小模型。
- 给每条承重关系找到证据或明确标为作者解释 / 结构推演;通常只需 1-2 个关键证据,再选择成本最低的表征。
- 依次写问题、洞见、带走,最后压出速读。
顶层章节固定为:
* 速读* 它到底在解决什么* 它真正看见了什么* 我能带走什么
Examples
评测论文
不要把「给科研想法加谱系评测」说成「科学想法真的像基因一样演化」。先发现读者对「机制继承」可能只有词感,没有概念:它不是主题相似,而是后一个方案接住并改动了前一个方案的作用关系。再用父子 proposal 的具体差异让这个概念工作,最后建立「继承关系怎样被新评测看见」的测量模型。
方法论文
不要停在「提出新模型并提升指标」。若论文在训练模型判断何时收尾,先补「收尾反馈」:它不是推理能力,而是系统根据当前答案状态决定继续计算是否仍有收益。把它与「更强推理」放进同一个案例比较,模型才会解释为什么答案已经正确,token 仍继续增长。
Completion
生成笔记后读回确认:
- frontmatter 完整,文件确实保存成功。
#+source只有一个裸 URL,没有描述文字或并列链接。- 顶层只有四个规定章节。
- 中心命题不是论文标题、模型名或贡献清单。
- 至少有一个贯穿问题、洞见和带走的具体锚点。
- 已扫描中心命题、机制和证据链;所有尚未形成的承重概念都被记录,外围术语没有混入清单。
- 每个被记录的概念都在区别、关系和案例中工作,而不是只有释义或类比。
- 概念按依赖顺序连接成模型;模型能解释原锚点、区分一个邻近情况,并对一个条件变化给出方向性预测。
- 每条承重关系都有相邻的证据,或被明确标为作者解释 / 结构推演;没有为了凑数堆实验。
- 证据、主张和适用边界彼此相邻,没有拆成实验摘要与独立免责声明。
- 已完成关系阻力与证据阻力扫描;解释模型若具有结构、形状或动态关系,没有只靠文字带过。
- 图表若存在,只看图能复述概念关系与判断变化,却不会得出超过证据的结论;ASCII 图格式与宽度合格。
- 若没有图表,短句确实已经是成本最低的表征。
- 主文没有未解释的 LaTeX 公式或旧模板章节;若保留最小公式,紧接着有人话翻译。
- 速读里的问题、洞见和带走构成因果链,而不是三个压缩后的亮点。
- 只读速读能回答「为什么需要这篇、它多看见了什么、以后怎样判断」;读完正文还能回答「我原先缺哪几个概念、它们怎样共同解释现象」。
Loading...
Select a file to preview
Analyzing security...
Checking scan reports and verification data.
Bill of Materials
Everything this skill can do — files, network, commands, and more.