科研入门:认识、查找、阅读、学习科研论文
科研论文
- 本文以计算机、医学以及两者交叉学科论文为大背景讲解,不适用于所有学科,仅讨论普遍现象,个别特殊情况不单独列出。
- 本文只针对超级萌新、研0选手,非常基础,对已具备独立思考能力的研究生作用不大。
- 后文部分案例以Heterogeneous Test-Time Training for Multi-Modal Person Re-identification为参考基准。
1. 认识科研论文
1.1 科研论文结构
-
研究的基本任务就是探索认识未知
-
科研论文是研究产生的成果之一,是展示、讲解、证明研究成果的一种手段,通常包含文本、公式、图像、表格等形式。

-
内容结构通常包含:标题 Title、作者 Authors、单位 Affiliations、摘要 Abstract、关键词 Keywords、引言 Introduction、相关工作 Related Work、方法 Method、实验 Experiment、讨论 Discussion、结论 Conclusion、致谢 Acknowledgement、参考文献 Reference、附录 Appendix等,但不一定每篇文章都包含所有部分。
| 组成部分 | 核心功能 |
|---|---|
| 标题 (Title) | 反映论文的核心内容、研究对象或主要发现 |
| 作者 (Authors) | 标明对研究工作做出实质性贡献的个人 |
| 单位 (Affiliations) | 指明研究归属机构 |
| 摘要 (Abstract) | 在极短篇幅内概括论文的研究背景、目的、方法、主要结果和结论,可以快速了解论文的核心内容和价值。 |
| 关键词 (Keywords) | 最能代表论文核心主题和研究内容的几个单词或短语。 |
| 引言 (Introduction) | 内容结构与摘要类似,篇幅更长。介绍研究领域的现状、重要性以及存在的问题;提出本文要解决的具体科学问题或研究目标;阐明研究的动机、方法、创新点和贡献。 |
| 相关工作 (Related Work) | 系统回顾和评述与研究问题密切相关的已有文献,明确本文工作与前人工作的联系与区别。 |
| 方法 (Method) | 阐述研究所采用的理论基础、实验设计、数据、模型、算法、技术等;提供实验细节,确保结果可复现。 |
| 实验 (Experiment) | 展示研究得到的数据、图表、现象等,并对结果进行描述、比较、统计分析或可视化。 |
| 讨论 (Discussion) | 对结果进行更深入的解释、阐释和推理,将研究和相关工作进行联系和比较。 |
| 结论 (Conclusion) | 总结与重申研究的主要目的、最核心的发现和最重要的结论(呼应摘要和引言)。 |
| 致谢 (Acknowledgement) | 感谢对研究有贡献但不足以成为作者的个人或机构,明确标注研究资助来源。 |
| 参考文献 (Reference) | 完整、准确地列出论文中引用的所有文献,尊重他人的知识产权和学术贡献,避免抄袭。 |
| 附录 (Appendix) | 提供对理解论文很重要但因篇幅、格式限制或影响行文流畅性而未放入正文的额外材料,代码、证明、推导等。 |
1.2 科研论文分类
| 维度 | 期刊论文 (Journal Paper) | 会议论文 (Conference Paper) |
|---|---|---|
| 核心目标 | 追求研究的深度、完整性和长期价值 | 强调创新性、时效性和快速交流 |
| 评审机制 | • 通常需要2-4轮评审:审稿周期长(数月到数年) | • 通常单轮或双轮评审:审稿周期短(几周到数月) |
| 发表周期 | 较慢(6个月-2年+),无固定投稿时间节点 | 快(投稿到发表通常3-8个月),有明确截止时间 |
| 内容偏好 | • 系统完整:需包含详细方法、实验、分析 | • 核心创新:允许初步成果或阶段性进展 |
| 篇幅限制 | 较长(通常无严格页限,可包含附录) | 较短(顶会正文规定页数,正文一般6-8页,严格限制) |
| 学术影响力 | 长期累积(影响因子、引用周期长) | 短期爆发(顶会录用即受关注,但引用衰减快) |
- 不同学科论文会被分配到不同领域,并且不同领域内部有不同机构进行等级划分(仅供参考),其中等级的标准包括 CCF、SCI、JCR 等多种。
- 期刊:SCI/JCR 一区 > SCI/JCR 二区 > SCI/JCR 三区 > ···
- TOP 期刊 > 非 TOP 期刊
- 期刊影响因子越大越好
- 期刊与会议:CCF A类 > CCF B类 > CCF C类 > 非 CCF
- 会议论文的特殊荣誉:
| 英文名称 | 授予比例 | 核心特征 |
|---|---|---|
| Best Paper Award | 0.1%~0.5% | 会议最高荣誉,通常仅1-3篇 |
| Best Paper Candidate | ~1% | 角逐Best Paper的候选论文(通常3-5篇) |
| Outstanding Paper Award | ~1% | (部分会议设置)领域细分方向的最高奖(如“最佳学生论文”) |
| Oral | 5%~10% | • 并非质量等级 • 因研究展示效果强被选做大会演讲(15-20分钟) |
| Spotlight | 10%~15% | • 短时口头报告(3-5分钟) • 吸引听众关注其墙报(Poster) |
| Poster | 剩余论文 | • 主流展示形式(90%以上论文) • 作者在展区与参会者面对面交流 |
-
质量
等级高低绝对不等于也不代表质量好坏,只能作为参考。
(1)一般情况下文章质量与发表刊物等级正相关,且高水平期刊或会议上的文章质量高于未经同行评审的文章(如预印刷网站 arXiv 的文章)。
(2)其他评估质量的指标:GitHub 项目的关注度、被引用次数、同行认可度(师兄师姐、老师专家推荐)等。 -
示例
通过谷歌检索文章标题、跳转至官网链接,可以看出本文被 Proceedings of the 38th AAAl Conference on Artificial Intelligence 收录,从名称可以看出是会议文章,并且标注为poster:

进一步,通过CCF分级搜索查看文章所属领域是人工智能,收录的会议水平为A类:

2. 查找科研论文
一篇论文包含三个方面的重要信息:所属领域、所做任务、所用方法,这三者都可以成为我们检索论文的切入点与关键词。由于导师的研究领域通常是固定的,一般导师会主动告知研究领域、或者从课题组发表论文名中可以很快了解到研究领域的信息。接下来将分两种情况进行介绍:
2.1 有明确参考论文
参考论文可以是课题已发表、组内传承的参考资料、自己感兴趣的文章等。有了完整的论文参考后,可以通过以下步骤进行广泛查找(以示例文章为例):
- 快速归纳论文的任务/方法
- 通常从标题、摘要、关键词等部分总结
- 示例:从标题 Heterogeneous Test-Time Training for Multi-Modal Person Re-identification 可以看出,本文的方法技术应该是:Heterogeneous Test-Time Training,研究任务应该是 Multi-Modal Person Re-identification。
- 总结关键词了解专业的表达
- 通过查阅中英文资料、相关文献,更新调整第1步的结果
- 示例:通过继续阅读文章内容后,总结出专业的表达如下:
方法:Test-Time Training
任务:Multi-Modal Person Re-identification
-
从文章出发挖掘信息,扩展阅读
-
“相关工作”章节通常会介绍与文章密切相关的领域、任务、方法知识,有助于初学者快速掌握
示例:Related Work 中包含了任务介绍以及技术简介:

-
关注文章中的“参考文献”:通常引用的文献都是跟文章内容高度相关的:推荐下载插件学术搜索阅读器,使用浏览器阅读文献时,可以直接点击出现参考文献的基本信息。
示例:

-
从谷歌学术中搜索本文标题,通过点击“被引用次数”,可以看到引用本文的文章,通常也有高度联系
示例:

-
-
通过搜索工具快速了解相关任务/方法
- 综述:通常会以任务/方法名为题,并包含 Survey 字眼
- 谷歌学术直接搜索任务/方法的关键词:最推荐、最权威
- GitHub的第三方整理:通常以“Awesome+任务/方法”为项目名
- 硕士、博士毕业论文:中文易于理解,但全面性与时效性有所欠缺
2.2 无明确参考论文
如果没有具体的参考论文,不知道如何查找文献,可以通过以下步骤进行尝试:
- 已知任务名、方法名时
- 可参考 2.1 的第 4 步进行查阅
- 通过知乎、博客等渠道找到感兴趣文献后,按 2.1 的步骤进行查阅
- 向导师、师兄师姐、同行求助,拿到推荐的文献后,回到 2.1 部分
- 一切未知时
- 向大模型表达自己任务需求、感兴趣的问题或技术点,让大模型给出相关的研究方向(更推荐,但需要核实表述是否专业)或几篇相关论文(慎用,可能会有编造文献的情况)后,回到 2.1 部分
- 找导师讨论,确定具体任务或方法点后,回到 2.2 的第 1 步
- 直接海量涉猎相关会议、期刊论文集,找到自己感兴趣的任务及相关论文后,回到 2.1 部分
3. 阅读科研论文
3.1 文献管理
以下情况是研究生常见的不足:
论文堆满桌面:重要文献被覆盖,实验复现时找不到原文;
忘记是否读过某篇:重复阅读浪费时间,或漏掉关键工作;
引用时东翻西找:相关工作部分逻辑混乱、文献不完备;
可以说:混乱的文献=混乱的研究!
- 基本要求
- 要有专门存放文献的文件夹
- 文件名要能体现论文基本信息:标题、收录信息、年份
- 文献需要添加标签,方便检索:所做任务、发表年份、收录在哪、是否有代码、是否阅读过等
3.2 文献阅读
- 初学者
- 通常的阅读顺序就是行文顺序
- 文章最为核心且浓缩的部分是摘要、引言,这两部分内容通常是高度凝练的,但又与全文其他章节呼应。通常来说,这两个部分字数上有所差别,但逻辑结构基本一致、目的相同:研究/任务背景,现有方法介绍,本文思路与方法概述,技术介绍,实验情况。
- 摘要/引言的每句话都有作用,要与后文内容呼应且一致。参考文献、附录的内容属于通用型章节,可对全文内容进行补充说明。 摘要/引言与其他核心章节基本的对应关系如下:
| 摘要/引言内容 | 对应章节 |
|---|---|
| 研究/任务背景、现有方法介绍 | 相关工作 Related Work |
| 本文思路与方法概述、技术介绍 | 方法 Method |
| 实验情况 | 实验 Experiment、讨论 Discussion |
示例(以摘要为例):

- 介绍本文研究的具体任务:Multi-modal person re-identification (RelD) seeks to mitigate challenging lighting conditions by incorporating diverse modalities.
- 现有方法的特点:Most existing multi-modal ReID methods concentrate on leveraging complementary multi-modal information via fusion or interaction.
- 现有方法的不足:However, the relationships among heterogeneous modalities and the domain traits of unlabeled test data are rarely explored.
- 本文方法思路:In this paper, we propose a Heterogeneous Test-time Training (HTT) framework for multi-modal person ReID.
- 技术介绍:We first propose a Cross-identity Inter-modal Margin (CIM) loss to amplify the differentiation among distinct identity samples. Moreover, we design a Multi-modal Test-time Training (MTT) strategy to enhance the generalization of the model by leveraging the relationships in the heterogeneous modalities and the information existing in the test data. Specifically, in the training stage, we utilize the CIM loss to further enlarge the distance between anchor and negative by forcing the inter-modal distance to maintain the margin, resulting in an enhancement of the discriminative capacity of the ultimate descriptor. Subsequently, since the test data contains characteristics of the target domain, we adapt the MTT strategy to optimize the network before the inference by using self-supervised tasks designed based on relationships among modalities.
- 实验情况:Experimental results on benchmark multi-modal ReID datasets RGBNT201, Market1501-MM, RGBN300, and RGBNT100 validate the effectiveness of the proposed method. The codes can be found at https://github.com/ziwang1121/HTT.
大家可以将摘要与各个章节进行比较,看是否对应;并尝试分解示例论文的引言部分
- 稍微进阶者
- 先确定自己的阅读目标:是为了了解任务背景?是为了复现方法?是为了与该文章对比?
- 针对性的挑选章节阅读
- 如果你还不确定读哪个章节,说明还不够进阶,老老实实按初学者步骤来
3.3 检验成效
阅读后尽量完成论文十问,并不一定每个问题都有答案,但可以基于此框架快速理解论文主旨:
- Q1 论文试图解决什么问题?
- Q2 这是否是一个新的问题?如果是一个新问题,它的重要性何在?如果不完全是一个新问题,那为什么它“仍然重要”?
- Q3 这篇文章要验证一个什么科学假设?
- Q4 有哪些相关研究?如何归类?谁是这一课题在领域内值得关注的研究员?
- Q5 论文中提到的解决方案之关键是什么?
- Q6 论文中的实验是如何设计的?
- Q7 用于定量评估的数据集是什么?代码有没有开源?
- Q8 论文中的实验及结果有没有很好地支持需要验证的科学假设?
- Q9 这篇论文到底有什么贡献?
- Q10 下一步呢?有什么工作可以继续深入?
要想回答好上述十个问题,仅仅阅读摘要与引言是不够的,需要对全文都有一定深度的把握并且有所思考。
4. 学习科研论文
4.1 用于科研
厚积而薄发,博观而约取。
在没有建立起对领域、对任务的基础认识前,想有所科研上的突破是很难的。
初学者要学会找到想要的文章(这种能力也需要不断练习与优化),再去阅读,最后才能谈理解、深入与应用。
如果能熟练完成文章检索、简单回答上述十个问题后,强烈建议阅读一下进阶版的论文阅读经验分享 :沈向洋、华刚:读科研论文的三个层次、四个阶段与十个问题
4.2 用于写作
- 好的文章绝对是赏心悦目的,初学者应该建立起自己的学术审美系统,培养自己的学术品味。
- 向优秀的文章学习章节组织、学习写作表达、学习图表设计等。
- 从模仿到创新,尝试复刻、学习、融会贯通优秀文章的风格。

1318

被折叠的 条评论
为什么被折叠?



