说实话——大多数拥有古书的人,并不是都能接触到博物馆级别的修复资源。你可能有祖父传下来的明代诗集,或者在跳蚤市场找到的1960年代工程学教材。它们泛黄、易碎,或许还有水渍。你想保存它们、数字化它们、让它们易于分享。但一想到要逐页扫描并手动进行OCR?那可是一个我们大多数人耗不起的月长项目。
这时候,Docly AI就能拯救你的周末。它不是什么博物馆级别的数字化工具——而是一个实用的解决方案,适合那些想要立即看到成果、又不失酷感的人。
为什么“古”书首先需要数字化的呵护
物理磨损增添了特色,但也让文字难以辨认。裂痕、褪色的墨水、污渍——这些都是传统OCR的噩梦。Docly的AI文本提取实际上能够较好地处理噪声。我在一份1940年代的上海地图指南上测试过,茶渍覆盖了一半的街道名称。它认出了每个字吗?没有。但它恢复了87%的可读文本,这比我眯着眼睛盯两个小时要好得多。
如果你想把那本破旧的家庭食谱变成可以分享给亲戚的电子文件,仅仅这一步就是突破。你扫描,让Docly提取,然后手动编辑混乱的部分。对于大多数个人收藏来说,这就“足够好了”。
从扫描的乱糟糟到“值得分享”的收藏品
真正的技巧不在于提取——而在于呈现。Docly的摘要功能听起来很简单,但操作方法是:拿一本200页的破烂小说,运行AI摘要,然后将关键章节或亮点复制粘贴到一份干净的Docly编辑PDF中。这样你就为原始文物创建了一个现代配套文件。你可以放心地分享它,而不必担心脆弱的书页。
我用祖父的一本1920年代工程学杂志做过这个——书页都在剥落。原版锁在盒子里。Docly版本直接发到了家庭WhatsApp群里。没人介意它是否“原汁原味”。他们只是想看他的笔记。
真正有意义的格式转换
这里有一个不那么明显的用法:Docly让你把这些PDF转换成更简单的格式,以便打印或重新出版。古书通常在现代屏幕上布局糟糕。字体太小,页边距不均。不用重新打字,提取文本,在Docly编辑器中重新排版,然后输出为干净的PDF甚至Word。你可以用现代排版重新装订,同时保留原内容。
代价:转换不会保留精确的页面布局。如果你的目标是复制一个摹本——请用600 DPI扫描并使用专业软件。Docly追求的是可用的副本,而不是博物馆级复制品。这个区别可以节省你的时间,只要你现实一点。
你会失去什么(所以要知道缺点)
说实话。Docly是一个AI PDF工具,不是奇迹创造者。它在严重退化的手写文字、极小字号以及不按线性排列的多列文本上表现不佳。我试过一个1950年代的中医教材,竖排文字加注释——输出结果需要大量校对。对有些人来说,这是个大问题。
另外,AI摘要可能会抹平老作者独特的行文风格。如果你想要保留作家的风味,那就提取但不摘要。手动使用编辑器清理。这是一个值得考虑的折中方案。
替代方案?Google Lens适合快速单页阅读。但对于一个想变成共享文档的多页项目,Docly在速度上胜出。它的杀手锏是批量处理枯燥部分——提取、轻度清理、格式转换——这样你就有一个基础文件可以精修了。
收藏家的实用流程
这是我的常用工作流程:用手机应用(CamScanner或类似)分批扫描书籍。将PDF导入Docly。运行文本提取。修正明显的错误(一本薄书大约30分钟)。然后编辑PDF,移除空白页,添加现代目录,并导出。总耗时:每50页书大约一小时,包括喝咖啡的时间。
如果你正在建立一个旧书数字图书馆——绝版手册、老式旅行指南、奶奶手写的食谱——Docly让你一个下午就能搞定。结果不是“完美”,但对于朋友、社交媒体甚至小批量印刷来说已经可以发表了。
说实话,对于那些原本在箱子里腐烂的东西,“好到可以分享”已经是一个巨大的胜利了。
评论
发表评论