藏书十年,家里却没有一张目录
买书这件事,一旦成了习惯就停不下来。书架满了就堆床头,床头满了就堆飘窗,飘窗满了就码地上。十年下来,各个房间的书架满满当当,粗粗一算少说也有上千册。
可要问一句"你到底有多少本书",你只能挠头。哪本书在哪个房间、哪个出版社出的、哪位作者的书收全了、缺了哪本没补齐、上个月借给老张的那本《百年孤独》到底还没还——全凭一张嘴和一副好记性。
你想过建一份电子目录。可拿起一本书,翻开版权页,书名、作者、出版社、出版年月、ISBN、页数、中图分类号,一条条往 Excel 里敲。敲到第三十本你就想放弃:一千本书,录到猴年马月?
你退而求其次,下载了几个扫码录书的 App。对着 ISBN 条码扫一下,蹦出来的信息却常常牛头不对马嘴——书名错、版本错、出版社张冠李戴。改错的时间,比手打还长。
藏书癖的快乐,就这样被"录入一千本书"的恐惧按在地上摩擦。你缺的不是书,是一份能把藏书变成数据、随查随用的电子目录。
不需要手打,也不用扫码,拖进去就完事
文档工作台做的事,就是把"翻版权页、手敲图书信息"这一步,从一个遥不可及的大工程,压成一个下午就能干完的小事。
不需要懂表格,不需要会扫码,更不需要一本本对着屏幕敲字。周末泡杯茶,拿起手机,一本一本拍下版权页,存成 PDF,回到电脑前全部框选拖进去。
然后告诉它你要提取什么:书名、作者、出版社、出版年月、ISBN、中图分类号、页数——想留哪些字段就填哪些字段。点开始,工具在后台用本地 OCR 引擎逐张识别版权页,所有数据都在你的电脑上跑,没有一本书的信息离开过你的电脑。
即使是那几本压在书架最底层、版权页泛黄发暗的老书,字号再小、排版再挤,也能高精度认出来。
在这个过程中,文档工作台一共做了三件事:
第一|逐页识别版权页,提取完整的图书信息。书名、作者、出版社、出版年月、ISBN、中图分类号、页数——从每张 PDF 版权页中自动精准提取,不再需要你凑着灯瞪眼看小字。
第二|按你指定的字段整理成规范表格。你填的字段就是 Excel 的列名,识别的结果就是行数据。书名一列、作者一列、ISBN 一列,整整齐齐,不用手动对齐、调格式、分表。
第三|一键导出为 Excel 电子书库。识别完成后,点击导出——
一千册书的全部图书信息,清清楚楚排列在一张 Excel 表上。排序、筛选、统计,随心所欲。
原本想想就头皮发麻的一千本书录入,现在一个下午全部搞定——包括你翻书拍照的时间。
调一调字段,想怎么管就怎么管
第一次跑完后,根据自己的需要做个微调。比如你最近想补全某位作者的全集——在字段配置里保留"作者"列,导出后用 Excel 的筛选功能一拉,缺了哪本一目了然,不用再一本本翻书架。
想统计家里藏书的出版社分布,看看到底是哪家出版社出了你的心头好——加上"出版社"列,一张表就把十年买书的品味摊开了。想整理一份借出清单,追回散落在朋友手里的书——加一列"借阅人",随手一记,再也不会忘。
同一个工具,通过增减字段就能适配你管理藏书的种种心思。不用为了每种需求单独找一套方案,也不用在好几个 App 之间来回折腾。
写在最后
不只是个人藏书家。书评博主整理推荐书单、旧书商批量登记收书信息、科研人员整理参考文献、图书馆管理员登记新书——所有想把"纸上的图书信息"变成"能用的数据"的人,都卡在同一个地方:信息明明印在版权页上,可要把它们变成一行行数据,中间隔了成百上千次翻页、辨认、敲键盘。
一册藏书没有记录,你就永远不知道它躺在哪个角落,买重了都不知道。一份目录常年缺失,你借出去的书就像泼出去的水,收不回来也查不到。更糟的是,藏书越多,这种失控越明显——直到某天你想找一本旧书,翻遍三个房间满头大汗,才想起来它三年前就借给谁了。
这里有一个关键区别:经营藏书这件事里,"录数据"和"读藏书"是两回事。
录数据是翻版权页、敲书名、对 ISBN、查错改错——这些交给文档工作台,一个下午跑完,字段整齐、零差错。
读藏书是读一本好书、写一段批注、给朋友荐一本心头好——这才是藏书真正的乐趣。
把录数据交给工具,把读藏书留给自己。你的书架,不该被一叠永远整理不完的版权页困住。
文档工作台下载链接
https://pan.quark.cn/s/82ef5efcf992
本地安装,几步上手。下个周末,试试把书架一锅端进 Excel。