我爷爷的旧工程教科书堆在一个箱子里。泛黄的书页,完好的装订,却没有一份数字备份。于是我扫描了全部15本书,每本400页。结果呢?一团糟。歪斜的页面、模糊的文字,以及那些字符看起来就像被搅拌机搅过一样。
就在那时,我不再把PDF修复当作简单的“扫描然后导出”工作。老实说,也就是那时Docly变成了我意想不到的东西。
扫描是简单的部分,修复才是噩梦。
大多数人以为OCR能搞定一切。但它不能。复古书籍有褪色的墨水、不规则的间距,还有1987年留下的咖啡渍。免费工具对此束手无策。它们要么跳过损坏的部分,要么输出一堆胡言乱语。
使用Docly时,我上传了一本1982年的物理学手册,它的书脊几乎散架了。AI文本提取不仅抓取了文字,还实际重建了断裂的行。它捕捉到了“electromagnetic”这个词,尽管字母“e”几乎看不见。仅此一项就为我节省了手动录入50页的时间。
我实际使用的三个功能
说实话,没人会使用一个工具里的所有功能。以下是我看重的:
- AI摘要用于章节回顾。我不需要重新阅读整节内容,而是把热力学的一章喂给工具,得到了一个干净的三段落概要。当你要对比两本相同主题的书时,这非常有用。
- 文档编辑,可以删除空白页(旧扫描件中常见)并重新排序章节,而不会让应用崩溃。其他编辑器在处理大文件时往往会卡死。
- 保留格式的文本提取。大多数提取器会把所有内容输出为纯文本。Docly保留了带编号的公式和表格结构——这些我本以为需要手动重建。
它的不足之处
并非一切完美。手写的边注?AI有一半时间直接忽略了它们。如果你的复古书籍有钢笔的注释或下划线,Docly会视其为噪声并丢弃。如果你要修复一本已经被他人用批注修改过的书,这就是个问题。
另外,免费版每月有页数限制。对于一个拥有50多本藏书的严肃图书馆,你需要付费计划。价格不贵,但需要纳入预算。
你应该考虑的权衡
如果你是为了归档而修复个人收藏,Docly是从脆弱纸张到可搜索PDF的最快途径。但如果你是为了历史准确性而保留每一处烧焦的角落和水渍,你可能需要更高级的修复工具,进行手动像素级清理。这是AI辅助,而非AI完美。
分界线很简单:如果你只想要内容可读、可搜索,Docly胜出。如果你把它当作博物馆展览来对待,继续寻找别的工具吧。
最后一句
我爷爷1982年的教科书现在变成了一个干净、可搜索的PDF,每一章都有AI摘要。我不需要学习Photoshop或OCR设置。我只是上传、点击、导出。这就是大多数人实际需要的“修复”水平——不是博物馆级别,但立即可用。如果你也有一箱旧书,那可能正是你想要的。
评论
发表评论