论文笔记模板
目的不是「读完」,而是把一篇论文消化成一段可以带走的知识:30 秒能说清贡献、5 分钟能复述方法、需要时能找到原文与相关笔记。
使用方式
- 在 文献收藏 首页把论文复制到
docs/papers/下,文件名用 「年份-简称」(如2017-attention.md),并登记到config.mjs侧边栏与本页索引; - 边读边填,读不透的字段宁缺毋滥——空着也是一种「待补」标记;
- 填完把「我的思考」里沉淀出的问题/启发,在顶部目录登记为该笔记的标签。
完整模板(直接复制)
markdown
---
title: 论文标题
description: 一句话贡献
tags:
- 论文
- <主题标签,如 深度学习 / LLM / 分布式>
---
# 论文标题
> **一句话贡献**:…
>
> **信息**:作者 · 会议/期刊 · 年份 · [arXiv 链接](…) · [代码](…) / 无官方代码
## 背景与问题
- 之前的工作做到什么程度(1-2 句,给出前驱工作或关键词);
- 本文要解决的痛点/空白,为什么重要(量化其代价更佳);
- 已有方案的不足(它们的假设在哪失效)。
## 方法
- 核心思想一句话;再拆成 2-4 个步骤/组件,每个用自己的话重述;
- 关键公式或架构图的**直觉解释**(它想让什么信息流动/约束什么,而非贴公式);
- 与最接近的前作相比,改动最小但最关键的一处是什么。
## 关键实验
| 实验 | 设置 | 结果 | 说明/对照 |
| --- | --- | --- | --- |
| 主结果 | 数据集/指标 | 数值 | 与哪些基线对比、赢在哪 |
- 结论的边界:哪些设置下有效/失效。
## 局限与展望
- 作者自述局限 + 我注意到的隐含假设;
- 后续工作(引用它的重要论文、本文提出的公开问题);
- 若方法已被更优方案取代,注明替代品(如 LoRA 之于 adapter)。
## 我的思考
- 这个思想**还能迁移到哪里**(业务/其他领域);
- 与我已有知识的连接(可链接本站其他笔记);
- 可执行行动(落地实验、代码练习、继续跟踪的后续论文)。各字段怎么填好
| 字段 | 要求 | 反例 |
|---|---|---|
| 一句话贡献 | 含动作 + 对象 + 收益,可当结论引用 | 「提出了一种新方法」 |
| 背景与问题 | 写前作与缺陷,不写科普 | 只重复摘要第一句 |
| 方法 | 用自己的话重述 + 图/公式的直觉 | 直接翻译原文段落 |
| 关键实验 | 数字、数据集、对照齐全,能支撑「贡献成立」 | 只写「效果很好」 |
| 局限与展望 | 至少一条「我没看到论文明说但存在的假设」 | 抄作者 conclusion |
| 我的思考 | 有迁移、有连接、有行动 | 「很厉害,值得学习」 |
示例:字段填法的示范
- 一句话贡献(好):「ResNet 用跨层恒等短路把梯度通路缩短,首次让几百层网络可训练,ImageNet 错误率降到 3.57%(超过人类 5.1%)。」
- 一句话贡献(差):「提出了深度残差学习的方法,效果显著。」
- 方法直觉(好):「残差块让网络只需学习'和恒等映射的差'——差的能量小、易学;短路项保证梯度至少有一条无损通道回传。」
- 思考(好):「短路思想后来渗透到 Transformer(LayerNorm 外的残差)、GAN、扩散模型,几乎成为深层网络的默认结构;可把'给梯度留一条直路'当设计模式复用到自己的网络/优化问题。」
写作规范速记
- 段落以结论开头,细节殿后;
- 论文间互相引用使用本站相对链接(如 Attention Is All You Need),形成文献网络;
- 数学符号用行内公式,复杂推导只保留直觉结论;
- 阅读方法、筛选与入库流程见 文献追踪方法。