
过去十年,全球公藏机构把大量中文古籍做成了高清影像,但它们分散在几十个站点上,多数只提供在线翻页,不提供整书下载。哈佛燕京的善本走 IIIF,国图的资源库走自有接口,日本各大学又各有一套阅览器。研究者想把一部书完整存到本地,往往要逐页另存。手工存图既慢,也容易漏页。
数字古籍图书下载神器bookget 解决的就是这个「最后一公里」:粘贴一个图书详情页 URL,把整部书的影像拉到本地。
BookGet:https://github.com/deweizhu/bookget
BookGet 是一个专门针对数字图书馆、古籍数据库和高清扫描文献设计的开源下载工具。与普通网页下载器不同,它不是简单地抓网页中的 JPG 链接,而是针对不同数字图书馆的页面结构、接口和高清图协议进行适配,可以自动找到一册文献背后的高清图片,再批量保存到本地。
BookGet 核心功能:
- 多平台支持:支持国内外数十家主流及公共数字图书馆(如国家图书馆、各省市图书馆、大学数字图书馆及各类数字古籍/博物馆数据库)。
- 高清原图抓取:自动解析并下载图书的最高画质图像,避免人工逐页截图或手动另存为的繁琐过程。
- 一键打包与转换:支持将下载的图片自动拼合或转换为标准的 PDF 文件,方便后续阅读与归档。
- 命令行与自动化:基于 CLI(命令行界面)设计,轻量高效,易于编写自动化脚本进行批量任务处理。
对于喜欢收集数字典籍、古籍善本、学术文献或电子图书的学者、研究者与数字收藏爱好者来说,BookGet 几乎是必备的“神器”。
类似 BookGet 的工具:
bookget-py:https://github.com/open-guji/bookget-py bookget python 版本,扩展了文字资源下载功能
漢籍合璧小工具实验室:https://tools.hanjihebi.com/ 提供了在线通用打包下载器/IIIF智能下载器/国土打包打包下载器/美国国会图书馆打包下载器等众多工具,推荐
IIIF 是一种用于图像和文档的开放标准,很多数字图书馆都支持 IIIF 协议,因此有很多支持通用 IIIF / 切片图下载工具。
Dezoomify
https://github.com/lovasoa/dezoomify-rs 通用 IIIF / 切片图下载工具,支持 IIIF、Zoomify、DeepZoom、Google Arts & Culture 等格式,把切片拼回单张大图
https://dezoomify.ophir.dev/ Dezoomify 网页版及其浏览器扩展。浏览器扩展扩展负责在页面中嗅探 info.json 等元数据地址,交给 dezoomify-rs 下载。特别适合“只能放大却不能下载”的图片时尤其有用
IIIF-Downloader:https://github.com/ClaudioMartino/IIIF-Downloader 通用 IIIF 下载器,单文件 Python,支持 IIIF 2.0 / 2.1 / 3.0
iiif-download:https://github.com/Segolene-Albouy/iiif-download 可限制最大边长、批量 Manifest,并抽出许可和作者等元数据