跳到主内容
Ai Lab
  • Claude
  • ChatGPT
  • Cursor
  • Claude Code
  • Codex

第 1 课 AI 助手:你的科研搭档

先认识你的搭档

这门课里几乎每一步都有 AI 参与:你负责提问题、给材料、做判断,AI 负责查、写、跑。 先弄清两类 AI 各管什么。

一、两类 AI,分工不同

类型 代表 擅长 不能做
对话助手 Claude、ChatGPT 解释概念、联网搜索、深度研究、读 PDF 改不了你电脑上的文件
编程 Agent Cursor、Claude Code、Codex 读写项目文件、运行命令、排错 不替你判断结果对不对

先熟悉一个对话助手和一个编程 Agent 就够了,不必全装。

二、对话助手的四种用法

  • 问答:不懂的概念,让它先给直观例子,再给准确定义。
  • 联网搜索:问最新的事情时打开搜索,让它附上来源链接。
  • 深度研究:花几分钟检索几十个网页,写成一份带引用的报告(第 2 课用)。
  • 读文件:上传 PDF、表格、截图,围绕文件内容提问(第 4 课用)。

三、编程 Agent:能动手的 AI

它能直接改文件、跑命令,所以要在一个专门的项目文件夹里用,改完先看它动了哪些文件。第 5 课的 LaTeX、第 6 课的代码和环境,具体操作都交给它。

四、交代任务的四句话

说清楚 例子
用什么 「用 notes.md 和 refs.bib」
要什么 「写一份两页的小综述」
交什么 「输出 main.tex 和编译好的 main.pdf」
怎么验收 「PDF 里没有 ??,每段至少一处引用」

我在学「图神经网络」。先用一个生活里的例子解释它在做什么,再给准确定义,最后出一道小题考我,等我回答后再纠正。

五、一句提醒

AI 会编造文献和数据,关键结论要回原文核实;使用 AI 要守学校、导师和期刊的规定,需要时在论文里说明用了哪些 AI。

小练习

  1. 挑一个你最近听到但不懂的科研名词,用上面的提示词问对话助手。
  2. 追问到你能用自己的话讲出来,再请它指出你哪里说错了。
  • Deep Research
  • Google Scholar
  • arXiv

第 2 课 找文献:AI 检索,数据库核对

AI 负责找,你负责核

用 AI 的深度研究快速摸清一个领域,再用数据库把它给的每一篇文献核实一遍。 后一步不能省。

一、先用深度研究摸清领域

在 ChatGPT 或 Claude 里打开深度研究(Deep Research / Research),把范围说清楚:

我是刚进组的本科生,方向是「机器学习预测材料性质」。请调研 2019 年以来的主要方法和代表工作,输出:① 一页领域概览;② 15 篇代表文献,每篇写标题、第一作者、年份、期刊或会议、DOI 或 arXiv 号,以及一句话说明它做了什么。

拿到的是线索,不是结论。

二、逐篇核对:AI 给的文献可能不存在

检查 怎么做
存在吗 在 Google Scholar 搜标题,能搜到原文
信息对吗 作者、年份、期刊一致;DOI 在 doi.org 能打开
说得对吗 摘要里真有 AI 概括的那个结论
是什么 研究论文还是综述?arXiv 预印本尚未经过同行评审

三、顺藤摸瓜

  • 点 Google Scholar 的「被引用次数」,看谁引用了它,找后续进展。
  • 翻文末参考文献,找前置工作。
  • 找到一篇好综述,比换十次关键词都管用。

四、常用入口

入口 用途
Google Scholar 覆盖最全,核对题录、查引用关系
arXiv 计算机、物理、数学预印本,最新但未经审稿
Web of Science / 知网 学校购买的数据库,下一门课讲期刊分区时会用到

小练习

  1. 选一个感兴趣的方向,用上面的提示词跑一次深度研究。
  2. 对清单里的每一篇做第二节的四项检查,标出 AI 说错的地方。
  3. 留下核实通过的 10 篇,下一课导入 Zotero。
  • Zotero
  • Better BibTeX
  • WebDAV

第 3 课 Zotero:建自己的文献库

文献放进库,而不是下载文件夹

Zotero 免费、开源,把题录、PDF、批注、笔记和引用放在一处。 写论文时一键插引用,换格式不用重排。

一、装好两样东西

  • Zotero 桌面端:在 zotero.org 下载。
  • Zotero Connector 浏览器插件:在论文页面点一下,题录和 PDF 一起存进库。

也可以把 PDF 直接拖进 Zotero,它会自动识别题录;只有 DOI 或 arXiv 号时,用工具栏的魔棒按钮添加。

二、整理:分类、标签、笔记

功能 用法
分类 像文件夹,按课题建;一篇文献可以同时放进多个分类
标签 标状态:待读、已读、重要
批注 在内置阅读器里高亮、划线、写旁注
笔记 读完写一页总结(第 4 课的模板)

三、三个常用插件

插件 作用
Better BibTeX 生成稳定的引用键,自动导出并持续更新 .bib 文件,第 5 课直接用
翻译插件 阅读时划词或整段翻译
AI 插件 在 Zotero 里直接让 AI 总结、问答;种类多、更新快,按课题组推荐装

安装方法:下载插件的 .xpi 文件,在 Zotero 里打开「工具 → 插件」,从文件安装。

四、同步与备份

  • 注册 Zotero 账号并登录,题录、笔记就能在多台电脑间同步。
  • 官方免费空间只有 300 MB,PDF 多了会满,可以改用坚果云等 WebDAV 网盘存附件。

五、课题组群组

  • 在 zotero.org 建一个群组,组里共享一个文献库:组会论文、课题必读都放这里。
  • 群组里的 PDF 占用群主的存储空间,建群前先商量好谁来开。

小练习

  1. 把第 2 课核实过的 10 篇导入 Zotero,放进同一个分类,全部打上「待读」。
  2. 安装 Better BibTeX,右键这个分类导出为 refs.bib,勾选「保持更新」(Keep updated)。
  3. 装一个翻译插件,打开任意一篇 PDF 试试划词翻译。
  • 三遍读法
  • AI 精读
  • Zotero 笔记

第 4 课 读文献:读法 + AI 精读

先会读,再让 AI 帮你读深

大多数论文读第一遍就能决定放下还是继续。 先掌握读法,AI 才能帮你读得更深,而不是替你读。

一、一篇论文由哪几块组成

部分 回答什么问题
标题与摘要 做了什么、结论是什么
引言 为什么做、和前人有什么不同
方法 怎么做的
结果(图表) 证据是什么
讨论与结论 意味着什么、局限在哪

二、三遍读法

遍数 时间 读什么 读完要能回答
第一遍 5–10 分钟 标题、摘要、各级标题、图、结论 讲什么?和我有关吗?
第二遍 约 1 小时 正文和图表,先跳过推导细节 怎么做的?证据够吗?
第三遍 按需 方法细节,设想自己来复现 有哪些假设?哪里能改进?

这个方法来自 S. Keshav 的短文 How to Read a Paper,值得一读。

三、AI 精读:三种问法

把 PDF 上传给对话助手(或用 Zotero 的 AI 插件),然后:

  • 解释:「第 3 节的 message passing 是什么意思?先给直观例子,再给准确定义。」
  • 追问图表:「图 2 的横轴和纵轴分别是什么?它支持了文中哪一句结论?」
  • 复述挑错:「我理解这篇文章的贡献是……请指出我说错或漏掉的地方。」

四、别被 AI 带偏

  • 让 AI 标明依据在原文第几节、哪张图,回原文找到了再信。
  • 分清「论文写的」和「AI 推断的」,笔记里只记前者。

五、一页笔记模板

写在 Zotero 这篇文献的笔记里:问题 / 方法 / 关键结果 / 局限 / 和我的关系,每项一两句话。

小练习

  1. 把第 3 课的 10 篇都读第一遍,给值得细读的改标签为「重要」。
  2. 挑一篇读到第二遍,用三种问法各问 AI 一次。
  3. 按模板写一页笔记,存进 Zotero。
  • LaTeX
  • BibTeX
  • xelatex

第 5 课 LaTeX:看懂它,交给 Agent

不用手写,但要看得懂

论文排版用 LaTeX:写的是带标记的纯文本,编译后得到排好版的 PDF。 写和编译交给 Agent,你负责看懂结构、检查结果。

一、源文件 → 编译 → PDF

main.tex(正文)+ refs.bib(参考文献)+ 图片 → 编译 → main.pdf

  • 公式、章节编号、交叉引用、参考文献列表全部自动生成。
  • 多数期刊和会议提供 LaTeX 模板,换模板就换格式。
  • 中文文档用 xelatex 编译,并使用 ctex 系列文档类。

二、看懂一份 .tex

\documentclass{ctexart} % 文档类型:决定整体版式(ctexart 支持中文)
\usepackage{graphicx} % 宏包:按需加载功能,这里是插图
\begin{document}
\section{引言} % 章节,编号自动生成
质能关系写作 $E = mc^2$。 % 行内公式
\begin{equation} % 单独成行、自动编号的公式
E_\mathrm{form} = E_\mathrm{total} - \sum_i n_i \mu_i
\label{eq:form}
\end{equation}
\begin{figure} % 图:图片 + 图注 + 标签
\centering
\includegraphics[width=0.8\linewidth]{fig1.png}
\caption{结构示意图}\label{fig:structure}
\end{figure}
如图~\ref{fig:structure},前人工作见 \cite{smith2024}。
\bibliographystyle{unsrt} % 参考文献格式
\bibliography{refs} % 文献来自 refs.bib
\end{document}

记住规律:\命令{内容} 设置格式,\begin{…}…\end{…} 包住一块内容,% 后面是注释。

三、引用是怎么串起来的

  1. Zotero 的 Better BibTeX 自动导出 refs.bib,每篇文献有一个引用键,比如 smith2024。
  2. 正文里写 \cite{smith2024}。
  3. 编译后,正文出现编号,文末自动生成参考文献列表。

图、表、公式同理:\label{…} 起名字,\ref{…} 引用它。

四、交给 Agent,你来检查

用 notes.md 的内容和 refs.bib 里的文献,写一份两页的中文小综述 main.tex,用 xelatex 编译成 main.pdf。每段至少引用一篇文献,不要引用 refs.bib 以外的文献。编译完告诉我有没有警告。

拿到 PDF 后对照下表检查:

看到什么 通常是什么原因
正文里出现 ?? 标签或引用键对不上,或编译没跑完整
参考文献列表为空 没找到 .bib,或没运行 BibTeX
中文变成空白 没用 xelatex 或没用 ctex
报错 Undefined control sequence 命令拼错,或没加载对应宏包
报错 Missing $ inserted 数学符号写在了公式外面

看报错只需找到以 ! 开头的那一行和行号,连同上下文交给 Agent 去修。

小练习

  1. 用上面的提示词,让 Agent 把第 4 课的笔记和 refs.bib 写成小综述。
  2. 打开 main.tex,找出文档类型、一个章节、一处引用分别在哪。
  3. 按检查表过一遍 PDF,至少发现一处问题并让 Agent 改好。
  • VS Code
  • conda / uv
  • Git
  • GitHub

第 6 课 代码与实验管理

让每一步都能找回来

命令交给 Agent 去敲,但你要知道项目放在哪、用的是哪个环境、存过哪些档。 出问题时,这三样能救你。

一、VS Code:放项目的工作台

  • 免费的代码编辑器,用「打开文件夹」打开项目——一个文件夹就是一个项目。
  • Cursor 是在 VS Code 基础上加了 AI 的版本,界面和用法基本相同。
  • 左边看文件,中间看内容,下方终端看 Agent 跑了什么命令。

二、Python 环境:每个项目一个独立房间

不同项目要的库版本常常冲突,所以每个项目建一个独立环境。常用工具是 conda 和 uv。

在这个文件夹里用 uv 建一个 Python 3.12 环境,安装 numpy 和 matplotlib,把依赖写进 pyproject.toml,最后告诉我怎么激活它。

你要会检查:当前用的是哪个环境(终端提示符或 VS Code 右下角),依赖文件在不在项目里。

三、Git:给项目存档

概念 好比
仓库 repo 被 Git 管起来的项目文件夹
提交 commit 一个存档点,附一句说明
历史 log 存档列表
回退 读档,回到某个存档点
.gitignore 不进存档的文件:大数据、密钥、临时输出

两件事要自己会:

  • 看懂 git status:哪些文件改了,哪些还没提交。
  • 写清提交说明:「加入第二组参数的对比实验」,而不是「update」。

四、GitHub:远程备份与共享

  • 把仓库推送(push)到 GitHub,等于云端备份,课题组也能看到。私有仓库免费。
  • 学生可以申请 GitHub Education,获得更多免费权益。
  • 不要上传:密码、API 密钥、未公开的数据。

五、实验记录:三样缺一不可

每次运行都要留下参数、结果、时间,以及对应的提交。可以让 Agent 在每次运行后自动往 runs.csv 追加一行。

小练习

  1. 让 Agent 把第 5 课的小综述文件夹初始化成 Git 仓库,写好 .gitignore(排除 .aux、.log 等编译产物)。
  2. 自己运行 git status,确认要提交的文件对不对,再提交一次。
  3. 在 GitHub 新建一个私有仓库并推送,在网页上看到你的文件。
  • 全流程
  • 交付清单
  • 自查

第 7 课 综合项目:从检索到 GitHub

把工具串成一条链

选一个小题目,用前六课的工具完整走一遍。 不求结论新,只求每一步都留下了能检查的东西。

一、五步走完

步骤 做什么 用到
检索 深度研究拿到文献清单,逐篇核实 第 1、2 课
入库 导入 Zotero,分类、打标签、导出 .bib 第 3 课
精读 至少 3 篇读到第二遍,写一页笔记 第 4 课
写作 Agent 写成 2–3 页 LaTeX 小综述并编译 第 5 课
存档 建 Git 仓库,推到 GitHub 第 6 课

题目自己选,或者请导师给一个。范围宁小勿大,比如「图神经网络预测分子性质的三类方法」。

二、交付清单

交什么 要求
refs.bib 至少 8 篇,全部核实过
Zotero 截图 有分类和标签,至少 3 篇有笔记
main.pdf 2–3 页,引用和图表编号正确
GitHub 仓库链接 至少 3 次有意义的提交
README.md 题目、怎么编译、哪些部分用了 AI

三、交之前自查

  • 每篇引用都能在 Google Scholar 搜到原文。
  • 文中每个结论都能指出出自哪一篇。
  • PDF 里没有 ??,中文显示正常。
  • 仓库里没有密钥、没有大文件。
  • README 写清了 AI 做了什么、你做了什么。

四、做完以后

这条链就是以后每个课题的起点:新方向先检索入库,读完写笔记,写作用 LaTeX,项目进 Git。下一门课会讲期刊分区和会议评级,帮你判断读到的论文分量如何、自己的稿子该投哪里。

课程管理登录

登录后可以修改课程文字、插入图片并发布。

编辑本节

用 ### 写小标题、**文字** 加粗,支持列表、链接、表格和代码块。上传或粘贴图片会插入图片链接;复杂图注与折叠内容保留为 HTML。

可拖入或粘贴图片(PNG、JPEG、WebP、GIF,单张不超过 8 MB)。保存草稿后可跨设备继续;发布才会更新学生看到的内容。

历史版本与恢复

展示最近 50 次保存与发布。恢复只更新草稿,不会立即改变公开课程。