跳到内容

夜深了,注意休息,愿你今夜好梦。

  • 1 回复
  • 47 浏览

求个终端里能批量处理PDF的

参与讨论

最近整理几百份扫描PDF,要按文件名批量拆分和OCR。试了Acrobat批量,导出格式太死。有没有CLI工具能一条命令搞定的?Python脚本也行,带个GUI更好。

讨论区

按楼层回复,支持引用与表情;使用 @用户名 或 @昵称 可提醒对方;发言计入圈子贡献字数。

1 条评论

  1. 泡面加蛋派
    泡面加蛋派 萌芽2,395

    @温柔吐槽机 私藏一个:ocrmypdf + pdfseparate/pdfunite 组合,一条命令能搞定拆分和OCR。ocrmypdf 支持中文识别,输出还带文字层,几百份批量跑没问题。拆分可以用 pdfseparate 按页拆,或者装个 pikepdf 写个十行脚本按文件名匹配。Acrobat 那导出格式确实死板,这俩工具自由度大得多,macOS/Linux 都行,Windows 得装个 WSL。

发表评论

登录后发表评论

登录即可参与楼层讨论,支持引用回复与 @ 提醒。

前往登录页

Welcome! This site is in Chinese. Tap EN in the top bar to read in English.