科研写作:记忆如何被埋进上千份 PDF
文献库只有在需要时,能把对的那一部分重新送到眼前,才真正有用。
做了几年研究之后,个人文献库会发生一件奇怪的事。
论文数量继续增长。你能随时想起来的数量,却不会。
刚进一个领域时,库里也许只有几十篇。你大致记得每篇在讲什么、某张图从哪来、哪个实验用了哪种方法。找东西很少很难,因为许多文献还停在工作记忆里。
几年后,可能有几百甚至上千份 PDF。有些认真读过,有些只为了一张图保存,有些做过批注或在组会上讨论过。还有一些留在库里,只因为当时隐约觉得:以后也许用得上。
论文都还在。
淡掉的,是你和它们之间的连接。
写作时,问题往往不是「我从没见过这类东西」。
而更像是:「我肯定在哪见过类似的。」
或者:「有一篇论文做过类似的事。」
有时只剩下:「我记得有一张图,可能和这个机制有关。」
你想不起标题、作者、年份,甚至想不起一个靠得住的关键词。
你记得的是一个形状。
搜索最管用的时候,是记忆已经变成语言之后
假设你在写钙钛矿体系里的缺陷钝化。
你隐约记得有一篇论文:掺杂减少了缺陷态,并影响了非辐射复合。
你试:dopant defect passivation perovskite。太宽。
再试:Mn vacancy passivation perovskite。还是不对。
打开一篇。材料体系错了。
另一篇讨论 Mn²⁺,但主要在讲发光调控,而不是你记得的那个机制。
你再试 defect suppression,再试 halide vacancy,也许再试一个你以为记得的作者名。
这种来回,对任何拥有大型文献库的人都不陌生。消耗注意力的,往往不只是搜索引擎好不好,而是把半成形的记忆翻译成系统能理解的查询。
人类记忆并不总是以语言的形式到来。
识别先于能够说出口的回忆。
你可能花十分钟想不起一篇论文的标题,然后看到中间三四行,立刻知道:对,就是这篇。
一小段文字有时能做到标题列表做不到的事。它带回的不只是论文,还有你当初在意它的原因:前面那张图、实验条件,甚至你第一次读时做的判断。
丢失的不只是论文本身
文献库里还堆积着许多从未变成正经笔记的东西。
一个你想再看的方法。一张提示了对照实验的图。Discussion 里一段当时和课题关系不大、却觉得值得记住的话。一个让你不安、却从未跟下去的结果。
几个月后,论文本身可能已经离开工作记忆,只剩一点模糊:我好像见过类似的解释。
这就是为什么一个大库可以既丰富,又奇怪地难以进入。
文件完好。附着在上面的想法却不在了。
这也解释了:为什么有人库里有一千篇,写作时却仍反复回到那熟悉的几十篇。其余的未必更没用。它们只是更难在要紧的那一刻被带回来。
有时你甚至不知道自己该去搜
还有一种比忘掉正确关键词更难的情况。
有时你根本没在找任何东西。
你只是在写。
也许 Results 正在进入 Discussion。你在解释光致发光的改善,论证自然走向缺陷钝化。
然后你碰到一段旧文字:同一种干预也影响了连续激发下的稳定性。
这一段现在可能需要去另一个地方。
起初的问题是「发射为什么变好」,现在可能变成:「这种干预是否同时影响了效率与稳定性?这个关系是否比原来的框架更有意思?」
这篇论文没有回答你正在问的问题。
它改变了问题。
这在真实研究里足够常见,所以我不愿把文献检索只当成「为已经成形的主张找依据」。一个忘掉的条件可以削弱结论。一张图可以提示比较。另一个体系里的机制可以让当前解释显得太窄。
有时文献之所以有用,恰恰因为它打断了你已经在走的方向。
让文献库以另一种方式进入写作
这也是为什么我不相信,大型文献库的答案只是「更多推荐」。
研究者很少缺论文。
有时更要紧的,是六个月前读过的那篇里被忘掉的三行。
想象稿子仍在眼前,自己库里的少量段落同时浮现出来。不是五十篇推荐,也不是把整个库压进上下文窗口。只是几段和当前这一段有合理关联的片段。
一段被忽略。
另一段确认实验条件确实可比。
第三段足够眼熟,让你停下来打开原始 PDF。
稿子本身已经提供了相当丰富的信号:你在讨论什么、刚刚确立了什么、这一段是在解释机制还是做比较、接下来可能需要什么样的证据。在某些情况下,这比离开写作流之后临时编出的关键词更有信息量。
通常的顺序是:隐约想起什么 → 停笔 → 编关键词 → 搜索 → 打开 PDF → 找到段落 → 回到稿子。
我更希望还能有另一种选择:继续写 → 少量相关碎片浮现 → 识别 / 记起 → 判断 → 必要时核对来源 → 决定下一步写什么。
搜索仍然重要。如果你知道作者、标题、方法或材料体系,搜索框正是你要的。
另一种模式有用的时候,是记忆不完整——或者你还没意识到,一篇旧论文可能根本就重要。
已经有工具在靠近这个工作流的某些部分。Jenni 让研究者把 PDF 以及来自 Zotero、Mendeley 的来源带进写作,用于引用、提问和 AI 辅助起草。Flowing 更偏向段落:按稿子上下文,从研究者自己的文献库里重新浮现片段。
我更关心的不是哪种实现胜出,而是工作流本身的这种转移。
文献库不该等到想对关键词才有用
个人文献库不该等到我想起正确关键词,才开始变得有用。
有时它能做的最有价值的事,就是把一段我已经忘掉的碎片送回来——恰好在它会改变我下一句要写什么的那个点上。
Substack
探讨新一代的写作工具
欢迎加入 Substack,一起讨论证据驱动的 AI 写作、本地论文库,以及学术工具的下一步。订阅即可跟上最新文章。
加入 Substack