calibre:电子书格式转换与书库管理一步到位,30 种格式随便转
【免费下载链接】calibreThe official source code repository for the calibre ebook manager项目地址: https://gitcode.com/GitHub_Trending/ca/calibre
EPUB 传不进 Kindle,网上下的 PDF 版式锁死、字号纹丝不动,下载来的书连个封面都没有——这是电子书读者的日常。calibre 是一个开源、跨平台(Windows/macOS/Linux)的电子书管理器,核心能力就是电子书格式转换:30 种输入格式可以互转成 20 种输出格式,顺带把元数据、封面、目录、设备传输全揽了。
calibre 替你干的四件事
拖进去就能转:格式转换一步到位
困境:每台设备都有自己的口味,Kindle 想吃 AZW3,手机吃 EPUB,手里的文件却不是你要的格式。
机制:calibre 的转换不是把文件"搬个家",而是一条三段式流水线——输入插件先把源文件转成 XHTML(一种跨平台的轻量标记格式,相当于转换过程中的通用语言),中间做章节检测、目录生成、字号统一等变换,最后由输出插件打包成目标格式。所以转换质量高度依赖源格式:官方给出的优先级里 LIT、MOBI、AZW、EPUB 靠前,PDF 垫底。同款书有多个格式时,优先喂 EPUB。
操作:选中书籍,点"转换书籍"→"逐个转换";对话框右上角下拉框选目标格式;点确定,几秒到几十秒搞定。想要文件本体就点"保存到磁盘"。
结果:书旁边多出新格式图标;转坏了也不怕,点对话框里的调试图标指定一个文件夹,各阶段的中间 XHTML 会分别落到 input、parsed、structure、processed 四个子目录,哪段坏了查哪段。
封面和作者,一键补齐
困境:下下来的书没作者、没封面,文件名是一串乱码,书库像杂货摊。
机制:calibre 用你填的关键字去 Google Books 和 Amazon 检索,把标题、作者、系列、标签、评分、简介和 ISBN 一次性填好;有 ISBN 还能直接拉封面。
操作:选中书按 E 键打开元数据编辑;在标题、作者栏填关键字;点"获取元数据"。
结果:封面网格里灰扑扑的默认封面变成真实书封,左侧标签浏览器也多出可筛选的作者和标签条目,批量补几本书后书库立刻清爽。
编辑书籍:改错字调排版不用开第三方工具
困境:转换解决不了"源文件本身有病"——比如章节标题被写成普通段落,怎么转都救不回来。
机制:calibre 能把书当一个包打开:左边是 HTML、CSS、图片的文件树,中间是源码,右边实时预览,EPUB 和 AZW3 都支持,改完保存即就地更新。
操作:右键书籍选"编辑书籍";大改之前先"编辑→创建检查点"存个快照,反悔能整体回退;修完保存,再走一遍转换,修复后的结构就会进入目标格式。
虚拟书库:只动你想动的那批书
困境:书库上百本,批量转换或改元数据没法全选了事。
机制:虚拟书库本质是一个搜索条件——建好之后整个界面收窄到子集,连左侧标签浏览器都只显示这批书的标签。
操作:点搜索框左侧"虚拟书库"→"创建虚拟书库",选一位作者,立刻切到只含这位作者书的视图;在这个视图里做批量转换或批量编辑元数据,其余的书天然隔离。
结果:因为底层就是搜索,rating:>=4、date:>30daysago这类条件都能当建库依据。
三步上手:装好、拖入、转换
- 安装。从官网下对应平台安装包;Linux 走包管理器也行。首次启动让你选书库位置,挑块空间充足的盘——calibre 为每本书建独立文件夹,且只复制文件,不碰原件。
- 加书。把电子书文件直接拖进主窗口,或点"添加书籍"。元数据自动读,读不出来它会猜文件名。
- 转换导出。选中→转换→保存到磁盘,或连接阅读器后直接"在设备上发送"。
命令行批量转:两条最常用命令
图形界面之外,calibre 附带ebook-convert命令,接受与 GUI 相同的全部选项,适合放进脚本做定期批量任务。
# 单本转换,并用 CSS 选择器手动指定一级目录 ebook-convert input.epub output.azw3 --level1-toc '//*[@class="chapter"]'# 输出流水线各阶段中间文件,配合冗长日志排查排版问题 ebook-convert input.epub output.azw3 -vv --debug-pipeline debug_folder第二条把各阶段 XHTML 落到 debug_folder,是定位"为什么目录没生成出来"这类问题的最短路径。
常见现象:为什么转换结果不对劲
- PDF 转出来段落断裂、目录丢失。PDF 是固定版式,官方 FAQ 原话是"PDF 是一个糟糕的转换源格式",逐行识别、硬换行、图片化文字都会出问题。能换源格式就换 EPUB/HTML;只能给 PDF 的话,先在转换对话框的"结构与元数据"里检查章节检测规则,接受一点人工检查成本。
- 中文 TXT 转完全是乱码。是编码猜不准。在转换对话框"外观→文本"里找到"输入字符编码",手动指定 GBK 或 UTF-8。批量加 HTML 文件则去"偏好设置→高级→插件"给 HTML to ZIP 插件设编码,网络来源的文件常试 cp1252。
- 转成 MOBI 后 Kindle 目录点进去跑到书尾。MOBI 没有真正的元数据目录,calibre 默认在书尾生成一个模拟目录,"跳到目录"指向它。保持默认别关,关了翻页等功能可能异常;新设备优先转 AZW3,它有正经的元数据目录。
- 加进 calibre 会不会改坏原文件。不会。导入是复制,书库目录和原始目录是两套独立文件;"保存到磁盘"导出的也只是当前格式的一份副本。
- 带 DRM 的购买书为什么转不了。calibre 明确拒绝转换受 DRM(数字版权保护)的书,这涉及法律边界,得先自行处理再交给它,风险自担。
更多细节见 转换手册 和 官方 FAQ,设备连接、新闻订阅等章节都有覆盖。
【免费下载链接】calibreThe official source code repository for the calibre ebook manager项目地址: https://gitcode.com/GitHub_Trending/ca/calibre
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考