【arXivArcher】v2.0 版本更新 | 大模型阅读 | 多数据源支持

阅读

【arXivArcher】v2.0 版本更新 | 大模型阅读 | 多数据源支持

很久不见。距离上一次的版本发布,转眼竟是已经四个月时间。这四个月里,个人的生活节奏也发生了好多变化,导致这个软件来到了疑似荒废的程度。

顺带一提,短短四个月时间,GPT 从5.2一口气到了5.6,我的主力开发工具也从claude code转换到了codex,消费方式也从最开始的PoE API Key到中转站,再到 gpt plus ,再到现在的 Pro Lite。

arXivArcher 的上一个发布版本我并不满意,因为它就是一个未完成作品,在消失的四个月里,还是陆陆续续在为它添加新的功能,让它能够更好的满足我的需求。 archer主界面

安装方法

Home-brew更新之后,安装方式发生了细微变化,需要多一条命令,安装后的体验是一致的,直接打开就可以使用,没有繁琐的签名流程。

1
2
3
brew tap gawainx/tap
brew trust --cask gawainx/tap/arxivarcher
brew install --cask arxivarcher

安装完成后,spotlight 或者其他常用的搜索应用上,输入“arxiv”即可打开。

新特性1: 多数据源支持

上一个版本把 arxiv 作为唯一的订阅数据来源,朋友圈有医学的朋友问,可不可以有更多数据源。于是,我这个版本中,arXivArcher 增加了两个来源支持:

  • bioRxiv 生物学预印文本库,可以阅读生物学领域的文献更新
  • medRxiv 医学预印文本库

有趣的是,维基百科中也表达,这两个文本库成立的初衷本来就是补充 arxiv 的领域限制,既然如此,本 Archer 也是做了一个有趣的致敬了。使用方法和添加arxiv订阅类似,只需要在订阅选单中选中不同的数据来源,然后订阅感兴趣的主题即可。

新特性2: AI 阅读

这个软件初衷就是让LLM介入整个论文发现、论文阅读过程,第一版解决了从无到有的过程,可以使用AI来完成摘要的翻译和总结。在使用过程中,我还想要更进一步。

我发现预印文本库的特点在于,每日更新的量很大,但是高质量的文章不多,有些更是写了一个看起来很牛逼的摘要,实际下载PDF回来发现内容乏善可陈,挂羊头卖狗肉。因此,希望更进一步消解这种文章。Archer 2.0 实现了论文AI阅读功能,只需要打开“第四栏”,输入想要提问的问题,软件就会自动获取arxiv paper 的html版本,完成内容清洗、上下文构建,然后发给模型完成阅读。

做这个功能的时候遇到了非常多的坑,这里也可以简要记录:

  1. Inspector 的归属问题:引入第四栏之后,工具栏挂给哪一层、界面的宽度如何定义 成了很难处理的问题,和 5.5 反复对话调整了好几轮,最后的取舍变成了——打开inspector之后,界面保持三栏,sidebar 隐藏。和GPT对话来处理UI问题确实很心累也很废tokens
  2. markdown处理:archer 是原汁原味的swiftUI应用,要承受原生应用才会有的问题,markdown的渲染和处理远远不如 electron 系列的应用成熟、很难做实时渲染。在实际调试的时候,还遇到了不同的控件抢夺main,导致内存泄漏、CPU满载的问题

其他附加特性

软件开发过程总是断断续续的,除了上面两个一定要拿出来宣传的特性之外,还搞了很多大大小小的功能:

  1. 独立笔记:在inspector中除了chat之外还有独立笔记,可以用于阅读过程的记录。不过这个功能目前属于存在但体验并未做好
  2. 根据arxiv id直接下载论文PDF:本来是为了适应前司的各种严苛网络限制,搞出来iOS app上处理下载论文的功能,现在似乎使用频率不高
  3. 直接拷贝 bibtex

Beyond - 迈向周更

archer 突然阔别四个月和突然开始更新的原因是同一个 - 因为工作。上一份工作的主力开发系统是Windows,而工作又占据了我非常多的时间,导致根本没有足够的时间自己测试和开发。

新的工作终于可以重回macOS作为主力开发机(不得不说,agent时代建议尽可能尝试和使用macOS),终于可以在工作的时候有时间重新看论文、follow 最新的研究趋势,既然开始用了,那就肯定会不断发现新的问题,完善 archer,让它成为一个更加趁手的工具。

使用 Hugo 构建
主题 StackJimmy 设计