本文件是 01.知识-05.Paper 下单篇文献介绍 / 解读类文章的作者侧写作规范。
目标:让对应领域的从业者或科研工作者读完后,能独立判断「这篇工作解决了什么、怎么做的、证据到哪、边界在哪、之后还有没有更好的路」,而不是背诵摘要。
正式对外的文献正文,禁止出现对本地其他文件包括本文件或「按范式写作」的任何引用(见「绝对禁区」)。
本文会随样例稿迭代;改结构时先改本文件,再回写样例,保持「范式 → 样例」单向一致。
命名约定
单篇文献介绍文件名优先沿用目录既有标识符体系:
1 | {文献标识}-{主题短名}.md |
| 字段 | 约束 | 说明 |
|---|---|---|
| 文献标识 | DOI- / PMID- / PMC- 等 |
尽量用可检索主键;DOI 中 / 换成 -(如 DOI-10.1038-s41586-…) |
| 主题短名 | 方法名或核心贡献短语 | 专有名词保留英文大小写(如 ProteinMPNN、RNAbpFlow) |
| 配图目录 | 与 .md 同名 |
./{文献标识}-{主题短名}/Fig1.png 或 fig-xx-*.png |
硬性:文件名、目录名、图片文件名均不得含空格。 需要分隔时用 - 或 _。正文叙述里专有名词可保留空格。
| 文类 | 命名提示 | 是否用本范式 |
|---|---|---|
| 单篇原文解读 | {标识}-{主题}.md |
是 |
| 方法/主题综述 | 可用 PMID…-…综述.md 等 |
可裁剪,见文末 |
| 系列专题(如 Hallmarks) | Series-….md |
另定骨架,不硬套 |
| 清单 / 索引 | Paper_list.md 等 |
否 |
| 公众号改写稿 | 可另存 …-wechat.md |
语气可口语化,但事实约束仍适用 |
读者与立场
读者:文献对应内容的行业从业者或科研工作者。默认具备该领域基本背景,不需要「零基础科普腔」;需要的是可核对的事实、清晰的方法逻辑、诚实的证据边界。
叙述视角:第三方。客观介绍研究内容,不站队作者,也不为抬杠而抬杠。
辩证立场(硬性):
- 文章内容不一定全对,也必然有覆盖不到或不完美之处;分享阶段禁止把原文奉若圭臬。
- 写「做了什么 / 报了什么」时,同时写「依赖什么假设」「没测什么」「结论能推多远」。
- 效果数字必须带对照条件(相对谁、在什么数据集/实验系统、是否同条件并行)。禁止把摘要里的倍数单独拎出来当绝对真理。
- 作者自称的「首次 / 突破 / SOTA」若出现,应用可核对证据复述,并注明「作者表述」或改写成可验证的比较句;读者侧不要跟着喊口号。
语气:
- 像同行做 journal club:把问题、方法、证据、漏洞摊开。
- 专业克制;允许「我认为证据偏弱的地方在于…」,但判断要落到具体设计或数据缺口上。
- 直接讲清楚即可,不要用「说人话 / 给普通人讲 / 一文读懂」等自我标榜式措辞。
与其他范式的边界:
| 文类 | 差异要点 |
|---|---|
| 工具推荐 | 工具文追求活人感与亲身经历;文献文以可核对证据为主,少用聊天腔与情绪标点 |
| 机器学习算法 | 算法文讲「一类方法怎么用」;文献文锚定这一篇工作的问题—方法—证据链 |
核心撰写原则
- 一条主线:全文只讲清「科学问题 → 当时背景缺口 → 本文思路/方法 → 解决了什么 → 效果到哪 → 局限与后续方案」;枝节用小标题或段末注释挂上。
- 先问题后方法:读者应先知道「缺什么」,再进入模型或实验细节;禁止一上来堆架构名词。
- 方法写到可复述:若涉及算法 / 模型 / 流程开发,必须把原理与关键设计写到「同行能口头复述主干」的程度(输入、归纳偏置、训练/优化目标、推理怎么用),而不是只贴一层广告式摘要。
- 效果与声明分开:先复述实验设置与主要结果,再单独写「能成立的结论」与「推过头的风险」。
- 发表后对照(硬性):写稿时开放检索原文发表日至当前时间节点之间,同问题上是否还有其他方案;有则给出可对照的对比(见结构第 7 节)。无则如实写「检索范围内未见明显替代主线」,并注明检索口径。
- 配图优先原文:原理图、流程图、主要结果图优先使用原文图(注意版权/许可;OA 且允许转载时注明出处与许可)。自绘示意仅用于补原文没有的直觉桥接,且图注标明「非原文图」。
- 缩写体例:首次用「中文全称(英文全称,缩写)」;同段末可用引用块短注;后文只用缩写。
- 公式:需要时用 LaTeX;符号首次出现用一句话定义。
绝对禁区
正文元写作禁令(硬性)
文献正文中禁止:
- 「结构见范式」「按本目录模板」「详见 00.范式…」等作者侧提示
- 把命名约定、目录规划写进读者可见正文
- 为凑结构而互引「请先读上一篇文献」——确需前置知识时,用一两句补齐,或外链权威资料 / preprint / 官方文档
外部论文、代码仓、补充材料可以链。
表达禁区(压低 AI 味)
- 教科书空开场:「在当今…快速发展的时代」「随着 AI / 组学的兴起」
- 套话堆砌:「首先…其次…最后」「综上所述」「值得注意的是」「让我们来看看」「不难发现」
- 高频踩雷词:「说白了」「意味着什么?」「这意味着」「本质上」「换句话说」「不可否认」
- 降智 / 营销腔:「说人话」「给普通人」「零基础也能懂」「干货满满」「一文搞懂」「赋能」「闭环」「颠覆式」「完美解决」
- 把作者宣传话术当事实:正文避免「震惊学界」「里程碑式」等无证据形容词
- 编造未做的实验、未读的引用、未检索到的「后续工作」——不确定就写不确定,或标「待核对」
推荐结构(可裁剪,顺序建议固定)
新稿默认按下列骨架。综述 / 短评可删节,但 文献卡片 / 科学问题与背景 / 思路与方法 / 主要结果 / 局限与审慎读法 / 发表后其他方案 建议保留。
0. 文献卡片(开场,必有)
先用几句话的文章概述概括本文工作(陈述事实,不用口号),用一张表钉提供元数据,再:
紧接 1~3 句:这篇工作针对什么对象、提出什么做法、主要声称什么结果(数字带对照条件)。
| 项目 | 写什么 |
|---|---|
| 题目 | 原文题名 |
| 期刊/预印本 | 名称 + 发表/上线日期(若有) |
| 作者 | 第一作者 + 通讯(机构可短写) |
| DOI/PMID | 可点击链接 |
| 代码/数据 | 有则给官方入口;无则写「原文未提供公开代码」 |
缩写首次出现按体例展开。
1. 要解决的核心问题(必有)
用可检验的问句或命题写清:作者要回答的核心科学问题 / 工程问题是什么。
避免空泛「提高精度」「推动领域发展」;写成「在某某约束下,能否做到某某」。
2. 现阶段的常见方案(必有)
2~6 段即可,覆盖:
- 当时主流做法是什么(方法族 + 代表工作,有文献则短引)
- 缺口或张力在哪(数据、假设、通量、泛化、可解释性、实验验证链等——对准本文后文要补的那一块)
- 必要时点一句:为何这个问题在发表当时值得做(资源成熟、临床/产业需求、前序模型刚可用等),禁止宏大叙事
背景是为后文方法服务的,不是学科史展览。
3. 作者提出的新思路(必有)
写清作者的关键假设或设计选择:相对背景缺口,他们押注在哪条路径上(例如「先加固稳定性再进化」「用碱基对条件化生成」)。
可用一小段「设计对照直觉」说明:如果假设不成立,实验上会看到什么。
4. 采用的方法与原理(有算法/模型/流程时必有;纯实验可缩短)
先几句话进行系统性概述,再进行详细展开。
4.1 何时必须写「系统方法」
出现下列任一情况,必须有独立方法节,且写到可复述:
- 提出新模型 / 新损失函数 / 新训练或采样流程
- 组合已有模块但关键在接口设计、条件化方式、约束或解码策略
- 湿实验为主但核心是新流程编排(如连续进化回路 + 计算设计接口)
4.2 建议写法(按计算/实验顺序,不按论文章节名堆砌)
- 输入 → 输出:模型或流程吃什么、吐什么
- 归纳偏置 / 关键模块:图、注意力、流匹配、能量项、筛选回路等——各用一两句说明「它在约束什么」
- 训练或优化目标:损失、选择压力、多任务权重;公式给最小必要集
- 推理 / 实验怎么跑:采样温度、迭代轮数、并行对照如何设置
- 与基线的差异点:相对旧方法,改动落在哪一层(特征、目标、搜索空间、验证协议)
配图:优先贴原文总览图(如 Fig.1);图注写「原文 Fig.x:…」,并注明许可(若适用)。
纯实验、无新算法的工作:本节可改为「实验设计要点」(对象、对照、读出指标、样本量逻辑),仍须让读者能复述实验逻辑。
5. 解决了什么问题 / 主要结果(必有)
按证据强度组织,而不是按作者故事顺序炫技:
- 计算机内指标(若有):数据集、对照方法、效应量
- 湿实验 / 临床前 / 真实部署(若有):对象、读出、失败与成功条件
- 消融或机制性对照(若有):用于支撑「关键模块是否真关键」
每个要点尽量做到:设置一句话 + 结果一句话 + 能/不能推出什么。
原文结果图优先引用;图注标明 Fig 编号与读图要点。
6. 局限、假设与审慎读法(必有)
至少覆盖下列中与本文相关的条目:
- 数据与分布:训练/测试是否泄漏;物种、长度、难度是否偏科
- 评价指标:是否替代真实目标(如序列恢复 ≠ 可表达可功能)
- 实验系统外推:模型体系、细胞系、动物、临床之间的距离
- 对照是否公平:算力、调参预算、是否同条件并行
- 作者未讨论但读者会问的点:可复现性、代码版本、阴性结果是否充分
语气要求:指出缺口即可,不必嘲讽;也不要用「瑕不掩瑜」一类把批评清零的套话收场。
7. 其他可对比参考的方法(依据检索结果可选)
检索义务:检索至写稿当日,优先以原文正式发表日(预印本则以上线日)为起点,检索后续同问题或强相关问题上的后续方法 / 改进 / 替代路线。如果没有后续文章在向前补充通问题或强相关的方法,如果没有可以不展示本部分。
推荐检索入口(按领域选用,不必全写进正文):Semantic Scholar / Google Scholar「cited by」与标题关键词、bioRxiv/medRxiv、相关会议与期刊 TOC、官方代码仓 Issues/后续 paper、综述中的方法表。
正文至少写清:
| 项 | 要求 |
|---|---|
| 检索口径 | 时间窗、关键词或「被引/相关工作」策略,一句话即可 |
| 有替代时 | 2~5 个可对照方案:各用「思路差异 + 适用边界 + 相对原文的增益/代价」 |
| 无替代时 | 明确写「在上述口径下未看到成为主流的替代主线」,避免假装检索过 |
对比表推荐列:方案 | 发表时间 | 核心差异 | 证据类型 | 相对原文何时更值得考虑。
禁止无依据的「全面超越」;不确定就写「公开材料不足以判定」。
8. 对从业者的可操作含义(可选但推荐)
2~5 条:什么情况下值得跟进该方法;跟进前应核对的数据/代码/许可;不建议直接迁移的场景。
保持第三方口吻,不写成软广。
9. 小结(必有)
本方法/思路/结果 在对应领域带来的贡献是什么;
3~5 条子弹:问题 → 思路 → 成果 → 最要紧的一条边界 → 领域/方向的贡献。
不用「综上所述」。
10. 参考文献与延伸(必有基础链接)
- 原文 DOI/PMID、补充材料、代码与数据入口
- 背景中引用的关键前序工作(宁缺毋滥)
- 第 7 节对比方案的文献链接
Front matter 建议
1 | title: {方法或贡献短名}:{有吸引力说明标题,适合公众号推广} |
title 避免「给普通人看的」「震惊」等与读者定位或辩证立场冲突的措辞;公众号改写稿可另存,不覆盖主解读稿标题策略。
配图约定
- 优先原文图:原理、流程、主结果直接用原文导出图;文件名可用
Fig1.png、Fig3a.png等与原文编号对齐。 - 版权:仅在许可允许时转载(如 CC BY);图注写清「原文 Fig.x,来源 DOI…,许可…」。不满足许可时改为文字描述 + 外链原文,或仅用自绘示意。
- 自绘示意:默认科普漫画 / 扁平示意;文件名
{短名}-fig{序号}-{英文短义}.png;图注必须标明「非原文图」。 - 正文引用:
;路径无空格。 - 一张图一个读点;图注说明对应文中哪一步或哪条结论。
质量自检清单
- 文件名含可检索文献标识;
.md/ 配图目录 / 图片名均无空格 - 开场有文献卡片 + 一句话事实摘要,无宏大叙事
- 写清科学问题与发表当时的背景缺口
- 有思路/假设;涉及模型或算法时方法节可口头复述主干
- 结果带对照条件;未把作者宣传当事实
- 有独立的局限与审慎读法,未把原文奉为圭臬
- 完成「发表日至写稿日」的开放检索;有对比或明确写无
- 原理/结果图优先原文,图注含 Fig 编号与许可/来源说明
- 无范式互引、无套话与踩雷词、无降智/营销腔
- 缩写体例符合项目约定;公式用 LaTeX
- 文末有原文与关键延伸链接
裁剪规则(作者备注)
| 情况 | 怎么裁 |
|---|---|
| 短评 / Journal club 纪要 | 可压缩方法细节,但问题、结果条件、局限、后续方案四块不建议删 |
| 方法综述(多篇) | 「单篇卡片」改为「问题定义 + 方法谱系表」;每条方法仍要边界与证据类型 |
| 预印本 | 卡片标明 preprint;结论语气更保守;后续方案检索含是否已正式发表 |
| 公众号改写 | 可增强叙事与比喻,但不得删改核心数字与局限;事实以主解读稿为准 |
迭代记录(作者备注)
| 版本 | 日期 | 变更 |
|---|---|---|
| v0.1 | 2026-07-29 | 初版:读者定位(从业者/科研)、第三方辩证立场、结构骨架、原文配图优先、发表后方案检索义务、AI 味禁区 |
后续若某类文献(临床试验、标准操作程序、纯综述)骨架不够用,在本表追加裁剪规则,避免为特例推翻主骨架。