社区
研三上学期,导师给我派了个活,两周内交一份文献综述,给开题用
研三上学期,导师给我派了个活,两周内交一份文献综述,给开题用。
方向是图神经网络在推荐系统里怎么用。
我当时是真信心满满。
知网、Google Scholar、arXiv,关键词换着花样搜,一下午下了六十多个PDF。
文件名一个比一个乱,1803点几几几几点pdf这种,鬼知道哪篇是哪篇。
那天晚上我心情挺好,感觉自己挺充实。
以为下到了就等于读到了。
第二天点开第一篇,英文摘要密密麻麻半页。
aggregation、embedding、message passing,一个词一个词查。
查完一句,忘一句。
半小时过去,这篇论文到底解决了什么问题,我说不清楚。
我还顺手把摘要复制去网页翻译,中英来回倒饬,越看越晕。
硬着头皮读了五篇,笔记记了一堆。
论文A用了GCN效果好,论文B改了采样更快,论文C提了个新指标。
写完自己看了一眼,这几句话之间半点关系都没有。
谁是谁的前作,谁在怼谁,这条线怎么走过来的,我一个都答不上。
到第十篇我彻底不想动了。
六十篇读了八篇就撂那儿,剩下五十多个PDF躺在文件夹里,跟没打开过一样。
两周过去一周半,我文档里就一行标题,底下三段互相不挨着的流水账。
那几天食堂三楼的空调坏了,吃饭都吃得一身汗,这事我记特清楚,别的倒想不太起来。
交上去那天,导师翻了两分钟,把本子推回来给我。
他说这不叫综述,是把读书笔记摞一块儿,他看不出这一行是怎么走到今天的,也看不出我站在哪条线上。
打回重写。
那晚我是真丧,坐在电脑前不知道从哪儿下手。
脑子一热,想着干脆让AI直接写一篇得了。
跟它说了个题目,图神经网络在推荐系统里的应用,写一篇文献综述,它唰唰给我吐出一篇,五千字左右,读着还挺顺。
我心里正美,顺手点开它引的第一篇想核对。DOI照着敲进去,是个编出来的号。
又点了两篇,一篇压根搜不到,还有一篇作者名字都对不上。手一下就凉了,吓得我把那篇文档直接删了。
这要是真交上去,那才叫社死。
后来我不敢再让它直接写整篇了,换了个用法,只让它帮我读。也不敢再让它给我推荐这个方向还有哪些经典论文,它一荐我就慌,谁知道是不是又编的。
把PDF往对话框一丢,跟它说,你是我的文献阅读助手,这篇你就用中文帮我读懂,分几块讲:一句话说这篇到底解决了什么问题,背景是前人哪没做好,核心方法讲给一个研究生听就行,术语第一次出现就用大白话解释别堆着不管,再说说证明了什么、提升了多少,还有它自己认的局限,最后来一张术语表,每个词一句话中文解释。
后头我还死磕着加了一句:只依据这篇论文里写的实际内容,论文没提的就老实说原文未明确,不许自己拿别的结论往里凑。
它给的总览确实清楚,原本我啃四十分钟还半懂的东西,五分钟看完主线。
但有一处我还是没懂,它说这篇用负采样提升了训练效率。
我追问它,你刚才说的负采样我没完全懂,就着原文给我举个具体例子,讲到我能合上文档跟同学复述清楚为止,别引入原文之外的东西。
它举了个例子,我又倒回去翻了两遍原文对照,这才算真懂了。
读到第三篇的时候,图书馆快闭馆的音乐响了,我才发现自己坐了三个多小时。
术语它翻译得也不老实,同一个词这篇叫聚合那篇叫汇聚,我自己都看糊涂了。
跟它说先给我出一张术语对照表,英文对应我自己定的中文说法,后面全文统一照这张来,不许一会儿一个译法,这才算消停。
让它把总结里提到的别的论文、还有关键实验数字单独列成表,标出在原文哪个章节哪张图,不确定的地方写待核不许瞎编,我照着PDF一条条核。
有一次它写的提升幅度跟原文对不上,差了快十个百分点,我盯着屏幕愣了两秒才反应过来——这数字它记串了。
从那以后这步我一次都没跳过。
室友那阵天天问我怎么还在看论文,我说导师要的东西,他哦了一声接着打他的游戏。
我自己攒了张表,一栏一栏填:编号、一作加年份、标题、解决的问题、用的方法、跟前人比改进在哪、局限、DOI,还专门留了一栏写我读懂了没,没读懂的那栏老实填否,那篇就不准进正文,哪怕导师催得再紧。
DOI我死活不让它自己填,自己从原文或者数据库上抠下来,它编DOI这事我算是学乖了。
十几篇读完,我把整理好的这张表整张贴给它。
跟它说别一篇篇复述,按方法分个组,每组说清共同思路,标出演进关系,谁是谁的基础、谁改进了谁,再告诉我这个领域现在公认卡在哪儿,有没有互相吵架的地方,而且只准用我贴的这些,不许引入表外的论文,脉络要是有缺环就直接说你可能缺一篇关键工作,别自己脑补填上。
它理出来一张脉络图,把十几个孤立的点连成了网,我盯着看了挺久。
但它理错了一处,把两篇论文的先后顺序搞反了,说A改进了B,其实B才是后出的那篇。
我回去翻了B的Related Work那段,原文写得明明白白,B是冲着A的局限去的。
把这处改回来,跟它说清楚重理一遍,脉络才算对上。
它倒是顺嘴点出这个领域现在卡的地方,图一大算起来就慢,这几派谁都没真正解决,我后来就是照着这个坑往下选题的。
那天晚上我妈打电话问我论文写得怎么样,我说还行,其实心里一点底都没有。
让它按我们理出来的这条线,给我三套目录:一套按方法分派,一套按时间,一套按问题、各路解法、还剩的坑这么排,每节标一下大概用表里哪几篇。
我挑了第三套,导师后来看了说这个顺,像在讲故事。
把几篇的笔记和我自己的判断一起丢给它,跟它说学术客观的语气,中文,大概四百字一段,每提到一篇论文就在句末标个编号,体现这几篇之间的关系别一篇篇罗列,只用我给的材料别自己补,还告诉它这只是初稿,我自己会再改。
它写出来是通顺,但每提到一篇加个编号,我得一个一个点开原文核对是不是真对得上。
核到第七个编号的时候,发现它把两篇的结论安反了,一篇的结果被写成了另一篇说的。
这种错藏得深,不点开原文根本看不出来。
我把这截图发去组里的群,问有没有人也踩过这种坑,过了大半天没人回。
我那晚把整段删了重织,改到快十二点。
改完那句话,读着才像是我自己讲的,不是它讲的。
说实话这个流程是真的快多了,但也没有想的那么轻松。
有两篇论文的结论是矛盾的,一篇说效果提升明显,另一篇复现出来说没那么明显。
这段我到现在还没想好怎么写,是直接摆出来说两边分歧在哪,还是先压一压往后放。
参考文献那块我打算交给Zotero导,省得它给我编DOI,但那边我还没导完,格式对不上的还有小十条。
还有五六篇下好了但没细读,标着我读懂了吗那栏,老实填的是否。
这些没读懂的,我告诉自己就是不能塞进正文,哪怕导师催得紧。
那五六篇PDF还摞在papers文件夹最底下,文件名还是那种乱七八糟的编号,我一直没顾上给它们改名字。
离交稿还有三天,文档字数比上次那版多了不少,但离导师要的那个量,还差着一截。
昨天晚上我又去便利店买了瓶水,回来路上顺手看了眼手机,微信一条没有。
那段矛盾结论我到现在一个字没敢碰,越拖越怵。这稿子最后能不能按时交上去,我是真不敢想,走一步看一步吧。
这几句是我那段时间跟它反复念叨的话,照抄改改就能用,就是引用、数字这些,我一条没漏地都翻回原文核过一遍才敢信。
- 读单篇论文:「你是我的文献阅读助手,这篇你就用中文帮我读懂,分几块讲:一句话说这篇到底解决了什么问题,背景是前人哪没做好,核心方法讲给一个研究生听就行,术语第一次出现就用大白话解释别堆着不管,再说说证明了什么、提升了多少,还有它自己认的局限,最后来一张术语表,每个词一句话中文解释。」
- 防瞎编:「只依据这篇论文里写的实际内容,论文没提的就老实说原文未明确,不许自己拿别的结论往里凑。」
- 追问细节:「你刚才说的负采样我没完全懂,就着原文给我举个具体例子,讲到我能合上文档跟同学复述清楚为止,别引入原文之外的东西。」
- 术语统一:「先给我出一张术语对照表,英文对应我自己定的中文说法,后面全文统一照这张来,不许一会儿一个译法。」
- 列表核对:「把总结里提到的别的论文、还有关键实验数字单独列成表,标出在原文哪个章节哪张图,不确定的地方写待核不许瞎编。」
- 梳理脉络:「别一篇篇复述,按方法分个组,每组说清共同思路,标出演进关系,谁是谁的基础、谁改进了谁,再告诉我这个领域现在公认卡在哪儿,有没有互相吵架的地方,而且只准用我贴的这些,不许引入表外的论文,脉络要是有缺环就直接说你可能缺一篇关键工作,别自己脑补填上。」
编者按
Kai 差点社死那次,写综述的人都该记一记:他丧到让 AI 直接吐一篇,五千字读着挺顺,顺手核第一篇引用,DOI 是编的号;再点两篇,一篇搜不到,一篇作者对不上。所以这篇的规矩得先立住:AI 能当你的助读和梳理,绝不能当代笔和检索。凡是要写进正文的——引用、数字、谁改进了谁——每一条都得你翻回原文核过才算数;没读懂的,一律不进正文,哪怕导师催得紧。
助读:让它讲懂,别让它发挥
把 PDF 丢进去,让它只干『读懂这一篇』这一件事:「你是我的文献阅读助手,用中文帮我读懂这篇,分块讲:一句话这篇解决了什么问题、前人哪没做好、核心方法讲到一个研究生能听懂、术语第一次出现就用大白话解释、证明了什么提升了多少、它自己认的局限,最后附一张术语表。」压舱的是这句约束:『只依据这篇写的内容,论文没提的就说原文未明确,别拿别的结论往里凑』。少了它,模型就开始替原文发挥。
卡住就逼它举例:Kai 有处『负采样提升训练效率』没读懂,他没算了,追了一句「就着原文给我举个具体例子,讲到我能合上文档跟同学复述清楚为止,别引入原文之外的东西」。『讲到我能复述为止』这半句是关键,它会一直往细里拆,而不是甩个定义就完。
核对:每个数字、每条引用都要能翻回原文
让它把读到的东西摊成一张能核的表:「把总结里提到的别的论文、还有关键实验数字单独列成表,标出在原文哪个章节、哪张图,不确定的写『待核』,不许瞎编。」然后你照着 PDF 一条条对。
最阴的错藏在这里:Kai 撞过好几种——提升幅度它记串了,跟原文差快十个百分点;两篇的结论被它安反,A 说的写成了 B 说的;梳理脉络时先后顺序也搞反过,说 A 改进了 B,其实 B 才是后出那篇。这种错不点开原文根本看不出来。他后来立了两条死规矩:表里专门留一栏『我读懂了没』,填否的不进正文;DOI 死活不让它填,自己从数据库抠。编 DOI 这事,栽一次就够长记性。
梳理脉络:只准用你给的,缺环让它直说
十几篇读完核完,把整理好的表整张贴回去,让它连点成线:「别一篇篇复述,按方法分组,每组说清共同思路,标出演进关系,谁是谁的基础、谁改进了谁;再告诉我这领域现在公认卡在哪、有没有互相打架的地方。只准用我贴的这些,不许引入表外的论文;脉络要是有缺环,直接说『你可能缺一篇关键工作』,别自己脑补填上。」Kai 后来选题,就是照它点出的那个坑——图一大就慢、几派都没真正解决——往下走的。
成稿只当初稿:让它按理出的线写段落时,加上『这只是初稿,我自己会再改』,并要求每提到一篇就在句末标编号。可编号得你一个个点开原文核——Kai 核到第七个,发现它把两篇的结论又安反了。连脉络先后它都会理错,理错了自己翻 Related Work 改回来,别信它第一遍。
两处 Kai 没做完的,你别学他拖:参考文献交给专门的工具去导,别再给它机会编 DOI;两篇结论打架的地方,直接摆出来讲分歧在哪,别让它替你和稀泥抹平。导师第一次打回他的稿子就一句话,看不出他站在哪条线上。这条线,得他自己走出来。
别信我们的,你自己试试
花 ¥10,看 Codex / Claude 真帮你做件事——把一件重复的活自动化、做个能用的小网页,或写个小工具,一个真任务绰绰有余。
3 天有效 · 含 2 张配图 · 一把 key,Claude 和 Codex 都能用
新文章第一时间发到你邮箱
新教程、实战笔记,偶尔聊聊产品更新。不发垃圾,随时退订。