现代科研基本工具了解
- AI 助手
- 找文献
- 管文献
- 读文献
- 写成 LaTeX
- 存进 GitHub
- 01
AI 助手:你的科研搭档
对话助手和编程 Agent 各管什么,怎样把任务交代清楚。
- 02
找文献:AI 检索,数据库核对
用深度研究摸清一个领域,再逐篇核实 AI 给的文献。
- 03
Zotero:建自己的文献库
一键导入、分类标签、插件、同步,以及课题组共享。
- 04
读文献:读法 + AI 精读
三遍读法打底,再让 AI 帮你解释、追问、挑错。
- 05
LaTeX:看懂它,交给 Agent
读懂 .tex 的结构和引用链,学会检查 Agent 编译出的 PDF。
- 06
代码与实验管理
VS Code、Python 环境、Git 存档与 GitHub 备份,留下实验记录。
- 07
综合项目:从检索到 GitHub
给一个小题目,把前六课的工具完整串起来走一遍。
第 1 课 AI 助手:你的科研搭档
先认识你的搭档
这门课里几乎每一步都有 AI 参与:你负责提问题、给材料、做判断,AI 负责查、写、跑。 先弄清两类 AI 各管什么。
一、两类 AI,分工不同
| 类型 | 代表 | 擅长 | 不能做 |
|---|---|---|---|
| 对话助手 | Claude、ChatGPT | 解释概念、联网搜索、深度研究、读 PDF | 改不了你电脑上的文件 |
| 编程 Agent | Cursor、Claude Code、Codex | 读写项目文件、运行命令、排错 | 不替你判断结果对不对 |
先熟悉一个对话助手和一个编程 Agent 就够了,不必全装。
二、对话助手的四种用法
- 问答:不懂的概念,让它先给直观例子,再给准确定义。
- 联网搜索:问最新的事情时打开搜索,让它附上来源链接。
- 深度研究:花几分钟检索几十个网页,写成一份带引用的报告(第 2 课用)。
- 读文件:上传 PDF、表格、截图,围绕文件内容提问(第 4 课用)。
三、编程 Agent:能动手的 AI
它能直接改文件、跑命令,所以要在一个专门的项目文件夹里用,改完先看它动了哪些文件。第 5 课的 LaTeX、第 6 课的代码和环境,具体操作都交给它。
四、交代任务的四句话
| 说清楚 | 例子 |
|---|---|
| 用什么 | 「用 notes.md 和 refs.bib」 |
| 要什么 | 「写一份两页的小综述」 |
| 交什么 | 「输出 main.tex 和编译好的 main.pdf」 |
| 怎么验收 | 「PDF 里没有 ??,每段至少一处引用」 |
我在学「图神经网络」。先用一个生活里的例子解释它在做什么,再给准确定义,最后出一道小题考我,等我回答后再纠正。
五、一句提醒
AI 会编造文献和数据,关键结论要回原文核实;使用 AI 要守学校、导师和期刊的规定,需要时在论文里说明用了哪些 AI。
小练习
- 挑一个你最近听到但不懂的科研名词,用上面的提示词问对话助手。
- 追问到你能用自己的话讲出来,再请它指出你哪里说错了。
第 2 课 找文献:AI 检索,数据库核对
AI 负责找,你负责核
用 AI 的深度研究快速摸清一个领域,再用数据库把它给的每一篇文献核实一遍。 后一步不能省。
一、先用深度研究摸清领域
在 ChatGPT 或 Claude 里打开深度研究(Deep Research / Research),把范围说清楚:
我是刚进组的本科生,方向是「机器学习预测材料性质」。请调研 2019 年以来的主要方法和代表工作,输出:① 一页领域概览;② 15 篇代表文献,每篇写标题、第一作者、年份、期刊或会议、DOI 或 arXiv 号,以及一句话说明它做了什么。
拿到的是线索,不是结论。
二、逐篇核对:AI 给的文献可能不存在
| 检查 | 怎么做 |
|---|---|
| 存在吗 | 在 Google Scholar 搜标题,能搜到原文 |
| 信息对吗 | 作者、年份、期刊一致;DOI 在 doi.org 能打开 |
| 说得对吗 | 摘要里真有 AI 概括的那个结论 |
| 是什么 | 研究论文还是综述?arXiv 预印本尚未经过同行评审 |
三、顺藤摸瓜
- 点 Google Scholar 的「被引用次数」,看谁引用了它,找后续进展。
- 翻文末参考文献,找前置工作。
- 找到一篇好综述,比换十次关键词都管用。
四、常用入口
| 入口 | 用途 |
|---|---|
| Google Scholar | 覆盖最全,核对题录、查引用关系 |
| arXiv | 计算机、物理、数学预印本,最新但未经审稿 |
| Web of Science / 知网 | 学校购买的数据库,下一门课讲期刊分区时会用到 |
小练习
- 选一个感兴趣的方向,用上面的提示词跑一次深度研究。
- 对清单里的每一篇做第二节的四项检查,标出 AI 说错的地方。
- 留下核实通过的 10 篇,下一课导入 Zotero。
第 3 课 Zotero:建自己的文献库
文献放进库,而不是下载文件夹
Zotero 免费、开源,把题录、PDF、批注、笔记和引用放在一处。 写论文时一键插引用,换格式不用重排。
一、装好两样东西
- Zotero 桌面端:在 zotero.org 下载。
- Zotero Connector 浏览器插件:在论文页面点一下,题录和 PDF 一起存进库。
也可以把 PDF 直接拖进 Zotero,它会自动识别题录;只有 DOI 或 arXiv 号时,用工具栏的魔棒按钮添加。
二、整理:分类、标签、笔记
| 功能 | 用法 |
|---|---|
| 分类 | 像文件夹,按课题建;一篇文献可以同时放进多个分类 |
| 标签 | 标状态:待读、已读、重要 |
| 批注 | 在内置阅读器里高亮、划线、写旁注 |
| 笔记 | 读完写一页总结(第 4 课的模板) |
三、三个常用插件
| 插件 | 作用 |
|---|---|
| Better BibTeX | 生成稳定的引用键,自动导出并持续更新 .bib 文件,第 5 课直接用 |
| 翻译插件 | 阅读时划词或整段翻译 |
| AI 插件 | 在 Zotero 里直接让 AI 总结、问答;种类多、更新快,按课题组推荐装 |
安装方法:下载插件的 .xpi 文件,在 Zotero 里打开「工具 → 插件」,从文件安装。
四、同步与备份
- 注册 Zotero 账号并登录,题录、笔记就能在多台电脑间同步。
- 官方免费空间只有 300 MB,PDF 多了会满,可以改用坚果云等 WebDAV 网盘存附件。
五、课题组群组
- 在 zotero.org 建一个群组,组里共享一个文献库:组会论文、课题必读都放这里。
- 群组里的 PDF 占用群主的存储空间,建群前先商量好谁来开。
小练习
- 把第 2 课核实过的 10 篇导入 Zotero,放进同一个分类,全部打上「待读」。
- 安装 Better BibTeX,右键这个分类导出为
refs.bib,勾选「保持更新」(Keep updated)。 - 装一个翻译插件,打开任意一篇 PDF 试试划词翻译。
第 4 课 读文献:读法 + AI 精读
先会读,再让 AI 帮你读深
大多数论文读第一遍就能决定放下还是继续。 先掌握读法,AI 才能帮你读得更深,而不是替你读。
一、一篇论文由哪几块组成
| 部分 | 回答什么问题 |
|---|---|
| 标题与摘要 | 做了什么、结论是什么 |
| 引言 | 为什么做、和前人有什么不同 |
| 方法 | 怎么做的 |
| 结果(图表) | 证据是什么 |
| 讨论与结论 | 意味着什么、局限在哪 |
二、三遍读法
| 遍数 | 时间 | 读什么 | 读完要能回答 |
|---|---|---|---|
| 第一遍 | 5–10 分钟 | 标题、摘要、各级标题、图、结论 | 讲什么?和我有关吗? |
| 第二遍 | 约 1 小时 | 正文和图表,先跳过推导细节 | 怎么做的?证据够吗? |
| 第三遍 | 按需 | 方法细节,设想自己来复现 | 有哪些假设?哪里能改进? |
这个方法来自 S. Keshav 的短文 How to Read a Paper,值得一读。
三、AI 精读:三种问法
把 PDF 上传给对话助手(或用 Zotero 的 AI 插件),然后:
- 解释:「第 3 节的 message passing 是什么意思?先给直观例子,再给准确定义。」
- 追问图表:「图 2 的横轴和纵轴分别是什么?它支持了文中哪一句结论?」
- 复述挑错:「我理解这篇文章的贡献是……请指出我说错或漏掉的地方。」
四、别被 AI 带偏
- 让 AI 标明依据在原文第几节、哪张图,回原文找到了再信。
- 分清「论文写的」和「AI 推断的」,笔记里只记前者。
五、一页笔记模板
写在 Zotero 这篇文献的笔记里:问题 / 方法 / 关键结果 / 局限 / 和我的关系,每项一两句话。
小练习
- 把第 3 课的 10 篇都读第一遍,给值得细读的改标签为「重要」。
- 挑一篇读到第二遍,用三种问法各问 AI 一次。
- 按模板写一页笔记,存进 Zotero。
第 5 课 LaTeX:看懂它,交给 Agent
不用手写,但要看得懂
论文排版用 LaTeX:写的是带标记的纯文本,编译后得到排好版的 PDF。 写和编译交给 Agent,你负责看懂结构、检查结果。
一、源文件 → 编译 → PDF
main.tex(正文)+ refs.bib(参考文献)+ 图片 → 编译 → main.pdf
- 公式、章节编号、交叉引用、参考文献列表全部自动生成。
- 多数期刊和会议提供 LaTeX 模板,换模板就换格式。
- 中文文档用 xelatex 编译,并使用
ctex系列文档类。
二、看懂一份 .tex
\documentclass{ctexart} % 文档类型:决定整体版式(ctexart 支持中文)\usepackage{graphicx} % 宏包:按需加载功能,这里是插图\begin{document}
\section{引言} % 章节,编号自动生成质能关系写作 $E = mc^2$。 % 行内公式
\begin{equation} % 单独成行、自动编号的公式 E_\mathrm{form} = E_\mathrm{total} - \sum_i n_i \mu_i \label{eq:form}\end{equation}
\begin{figure} % 图:图片 + 图注 + 标签 \centering \includegraphics[width=0.8\linewidth]{fig1.png} \caption{结构示意图}\label{fig:structure}\end{figure}
如图~\ref{fig:structure},前人工作见 \cite{smith2024}。
\bibliographystyle{unsrt} % 参考文献格式\bibliography{refs} % 文献来自 refs.bib\end{document}记住规律:\命令{内容} 设置格式,\begin{…}…\end{…} 包住一块内容,% 后面是注释。
三、引用是怎么串起来的
- Zotero 的 Better BibTeX 自动导出
refs.bib,每篇文献有一个引用键,比如smith2024。 - 正文里写
\cite{smith2024}。 - 编译后,正文出现编号,文末自动生成参考文献列表。
图、表、公式同理:\label{…} 起名字,\ref{…} 引用它。
四、交给 Agent,你来检查
用 notes.md 的内容和 refs.bib 里的文献,写一份两页的中文小综述 main.tex,用 xelatex 编译成 main.pdf。每段至少引用一篇文献,不要引用 refs.bib 以外的文献。编译完告诉我有没有警告。
拿到 PDF 后对照下表检查:
| 看到什么 | 通常是什么原因 |
|---|---|
| 正文里出现 ?? | 标签或引用键对不上,或编译没跑完整 |
| 参考文献列表为空 | 没找到 .bib,或没运行 BibTeX |
| 中文变成空白 | 没用 xelatex 或没用 ctex |
报错 Undefined control sequence |
命令拼错,或没加载对应宏包 |
报错 Missing $ inserted |
数学符号写在了公式外面 |
看报错只需找到以 ! 开头的那一行和行号,连同上下文交给 Agent 去修。
小练习
- 用上面的提示词,让 Agent 把第 4 课的笔记和
refs.bib写成小综述。 - 打开
main.tex,找出文档类型、一个章节、一处引用分别在哪。 - 按检查表过一遍 PDF,至少发现一处问题并让 Agent 改好。
第 6 课 代码与实验管理
让每一步都能找回来
命令交给 Agent 去敲,但你要知道项目放在哪、用的是哪个环境、存过哪些档。 出问题时,这三样能救你。
一、VS Code:放项目的工作台
- 免费的代码编辑器,用「打开文件夹」打开项目——一个文件夹就是一个项目。
- Cursor 是在 VS Code 基础上加了 AI 的版本,界面和用法基本相同。
- 左边看文件,中间看内容,下方终端看 Agent 跑了什么命令。
二、Python 环境:每个项目一个独立房间
不同项目要的库版本常常冲突,所以每个项目建一个独立环境。常用工具是 conda 和 uv。
在这个文件夹里用 uv 建一个 Python 3.12 环境,安装 numpy 和 matplotlib,把依赖写进 pyproject.toml,最后告诉我怎么激活它。
你要会检查:当前用的是哪个环境(终端提示符或 VS Code 右下角),依赖文件在不在项目里。
三、Git:给项目存档
| 概念 | 好比 |
|---|---|
| 仓库 repo | 被 Git 管起来的项目文件夹 |
| 提交 commit | 一个存档点,附一句说明 |
| 历史 log | 存档列表 |
| 回退 | 读档,回到某个存档点 |
| .gitignore | 不进存档的文件:大数据、密钥、临时输出 |
两件事要自己会:
- 看懂
git status:哪些文件改了,哪些还没提交。 - 写清提交说明:「加入第二组参数的对比实验」,而不是「update」。
四、GitHub:远程备份与共享
- 把仓库推送(push)到 GitHub,等于云端备份,课题组也能看到。私有仓库免费。
- 学生可以申请 GitHub Education,获得更多免费权益。
- 不要上传:密码、API 密钥、未公开的数据。
五、实验记录:三样缺一不可
每次运行都要留下参数、结果、时间,以及对应的提交。可以让 Agent 在每次运行后自动往 runs.csv 追加一行。
小练习
- 让 Agent 把第 5 课的小综述文件夹初始化成 Git 仓库,写好
.gitignore(排除.aux、.log等编译产物)。 - 自己运行
git status,确认要提交的文件对不对,再提交一次。 - 在 GitHub 新建一个私有仓库并推送,在网页上看到你的文件。
第 7 课 综合项目:从检索到 GitHub
把工具串成一条链
选一个小题目,用前六课的工具完整走一遍。 不求结论新,只求每一步都留下了能检查的东西。
一、五步走完
| 步骤 | 做什么 | 用到 |
|---|---|---|
| 检索 | 深度研究拿到文献清单,逐篇核实 | 第 1、2 课 |
| 入库 | 导入 Zotero,分类、打标签、导出 .bib | 第 3 课 |
| 精读 | 至少 3 篇读到第二遍,写一页笔记 | 第 4 课 |
| 写作 | Agent 写成 2–3 页 LaTeX 小综述并编译 | 第 5 课 |
| 存档 | 建 Git 仓库,推到 GitHub | 第 6 课 |
题目自己选,或者请导师给一个。范围宁小勿大,比如「图神经网络预测分子性质的三类方法」。
二、交付清单
| 交什么 | 要求 |
|---|---|
refs.bib |
至少 8 篇,全部核实过 |
| Zotero 截图 | 有分类和标签,至少 3 篇有笔记 |
main.pdf |
2–3 页,引用和图表编号正确 |
| GitHub 仓库链接 | 至少 3 次有意义的提交 |
README.md |
题目、怎么编译、哪些部分用了 AI |
三、交之前自查
- 每篇引用都能在 Google Scholar 搜到原文。
- 文中每个结论都能指出出自哪一篇。
- PDF 里没有 ??,中文显示正常。
- 仓库里没有密钥、没有大文件。
- README 写清了 AI 做了什么、你做了什么。
四、做完以后
这条链就是以后每个课题的起点:新方向先检索入库,读完写笔记,写作用 LaTeX,项目进 Git。下一门课会讲期刊分区和会议评级,帮你判断读到的论文分量如何、自己的稿子该投哪里。