【开源推广】不是让 AI 替你读论文,而是把论文一点点织进知识库:作为一名在读物理博士,我现在怎么用 Obsidian + Notemd 做论文深读与长期积累

如果是arXiv的话就更简单了,我记得L站内有arXiv的拉取方案,有佬友做过,非常适配,可以检索一下。PDF是相对麻烦的情况

1 个赞

对可研究方向的总结这块我自己感觉还是挺有意义的,当它针对核心概念进行发散讨论的时候很容易给你新的视角与想法,其他的我还得再想想

1 个赞

感谢佬的解惑,我前段时间体验了一段时间的obsidian,听佬这样讲应该是用对方法 :joy:。我先在的痛点是需要对论文的公式进行追问,但是我用了zotero里面的gpt插件感觉和我想要的差太远了。我现在用的是cherry studio来进行问答,然后将有用的回答导出放入obsidian,再让ai帮总结生成总结。这是我现在的一个想法。但是使用cherry studio有个痛点,对于文献解读太依赖嵌入模型的准确性了。

你可以看看我文中提到的smart composer插件,可能比较符合你的痛点(被举报前的原帖子里我对插件做了一些推荐),这里放一下我比较推荐的几个插件。


这是smart composer插件的效果,功能还可以

1 个赞

哇,我最近在啃生肉小说,经常遇到查一个生词蹦出一堆关联知识点的场景,自己整理笔记太费时费力而且打断阅读节奏,不知道能不能用上佬友的项目

你别说,这真专业对口,记得要把Batch Generate from Title任务的prompt修改一下,修改成你阅读领域的。
原版默认的提示词是给理工科,可以复制粘贴给ai问问针对你这个领域怎么改,然后自己调试一下,如果有什么问题可以在这里问我

因为这个插件就特别适合对不熟悉领域的辅助探索,是不限学科的,也很容易自定义prompt。

关于论文方法论其实取决于你讨论的是写论文还是读论文。

从读论文的角度来说,其实这个插件的诸多功能就是一种方法论的体现,特别是针对如何尽可能从一篇论文提取对你来说有价值的知识点,无论是提取概念,基于概念生成,还是提取特定原始内容等等的功能,都是贯彻了一套方法论的思想所以如果佬友有什么需求,其实我们就是在进行方法论的交流

到了从标题批量生成这一步用时太久了,预估要120min,不知道有没有佬友跟我遇到一样的情况 :cry:

我猜测你没有使用并行处理功能,插件功能是支持并行调用api的,所以处理速度是限制于你的上游api的并发支持与处理速度,与插件本身的处理时间无关。具体位置在这里。

另外,如果觉得提取的概念过多,有以下方案可以检查与选择:

  • 如果模型支持,可以调节temperature(一般是降低)
  • 如果打开了thinking,可以考虑降低thinking强度或关闭thinking

如果觉得处理的速度太慢,本质上是api调用与处理速度慢,可以考虑使用

  • 无thinking模型,但可能会导致输出质量降低
  • flash或其他等速度较快的模型
  • 高质量高速高并发渠道
  • 人工审核一遍概念,剔除不需要的概念
  • 通过修改prompt的方法针对所用领域修改概念提取选择性(一般最后才使用,如果修改不好可能导致输出结果质量不足,建议先进行少量测试再确认进行批量使用)

好的感谢佬,目前打算换个模型试试

可以说一下现在是用什么模型吗?我看看能不能给一下建议。

目前用的GPT5.5,速度太慢了

了解,可以考虑使用deepseek与gemini以及grok,如果继续使用gpt的话也可以检查一下是不是有thinking模式的影响


佬,我现在用的gpt5.5,也是遇到了处理时间太长这个问题,我也设置了并行处理,还有什么方式能提高速度吗?

建议你可以先用短文尝试,比对不同模型的效果再做决定,不建议一上来就用长文实现,一方面是节省token,另一方面是更快地可以得到反馈以及针对自己对某个领域的需求进行模型参数调整.

thinking的强度可以看一下是否可以调低,具体可以看31楼我的回复

1 个赞

码住了佬,之前就想尝试一下Obsidian,但我有一个疑问,目前我习惯在zotero里面整理文献啥的,它和zotero的联动如何呢。

1.目前我在开发对pdf的支持,但由于pdf本身的格式不便于ai修改,支持应该是有限的.
2.如果是平面格式的笔记记录文档,可以考虑直接将对应笔记的大文件夹作为vault直接用obsidian打开
3.事实上,pdf并不是一个有利于后续与ai交互的格式,这也是为什么我在文章开头就说先把pdf转化为markdown格式,除了我这个插件,转成markdown之后可以使用无数的obsidian高质量插件对文献进行高质量的处理.

就我的插件而言,批量翻译所有文献以及从一个领域的文献中批量提取关键词并去重等高质量提效功能都是直接支持的.

另外,目前pdf转换为md格式的方案很多,比如百度的飞桨 paddle ocr,还有mineru等,可以酌情选择,mineru目前是最小白友好且兼顾质量的方案.

最重要的是,我目前还在开发一键ai基于markdown批量导出ppt/html/mp4的演示文稿与视频功能,上述功能的前提都是你得先把pdf转换为markdown格式以便于ai处理以及高效提取信息

好的感谢了,看来我要首先去学习一下obsidian的使用才能刚好的了解您这篇帖子,期待佬的后续更新
我目前是有点舍不得zotero的插入文献功能,看来以后可以考虑只用它插入文献了

1 个赞