Book118文档下载器3分钟把文档存成PDF【免费下载链接】book118-downloader基于java的book118文档下载器项目地址: https://gitcode.com/gh_mirrors/bo/book118-downloader想把Book118网站上的文档存到本地官网只给免费预览只能看到一部分页、图片小逐页截图又乱又不齐。Book118文档下载器是一个用Java写的小工具输入文档编号它会把文档所有可预览的页面抓下来拼成PDF存到你的本地磁盘上。 它替你省了什么麻烦第一替你干逐页截图的活。输入编号后工具把所有可预览的页面一张张抓全拼成一份能直接读、能打印的PDF你不用再一页页点下一页。第二文件留在自己手里。整个过程都在你电脑上跑图片下到临时目录、在本地拼成PDF跑完自动删掉临时文件文档内容不经过任何第三方转换服务。第三省等待。解析时它分批向预览接口要页面终端实时显示已下载的页数进度往上爬你心里就有数。和别的方式比一比手动截图在线转换Book118下载器耗时逐页操作慢中等输个编号自动跑质量马赛克、不统一可能被压缩保留预览图数据去向自己手里对方服务器全在本地⚡ 三步拿到第一个PDF第一步检查环境需要Java 8及以上java -version第二步克隆代码并构建产物是一个可执行的jargit clone https://gitcode.com/gh_mirrors/bo/book118-downloader cd book118-downloader mvn package不想自己构建的话也可以直接拿项目release里预编译好的版本Windows上双击run.bat就能跑。第三步运行并输入文档编号。编号就是文档页URL结尾的那串数字比如113657916.shtm里的113657916java -jar target/book118Downloader-V2020.jar下载开始后终端会一页一页刷进度提示生成完成时按文档编号命名的PDF已经躺在out/目录里了。【此处插入图片Book118文档下载器终端输入文档编号并输出下载进度的截图】【此处插入图片Book118文档下载器在out文件夹生成的按编号命名的PDF文件】 它是怎么下载文档的说白了这个工具就像一个替你翻预览页的人。它先用浏览器的口吻请求预览页从页面里读出预览所需的凭证项目ID、访问令牌之类再照着网站自己预览时走的那条路线一页一页要预览图——每次请求之间还故意睡1秒免得被服务器嫌太快拦下来。图片收齐后按页码排好序再逐页拼成PDF。入口是src/main/java/me/rainking/BookDownloader.java只负责读入编号、启动流程解析预览信息、抓页面图、下载这些脏活在src/main/java/me/rainking/DocumentBrowser.java里完成最后把图片拼成PDF的src/main/java/me/rainking/PdfGenerator.java用的是iTextPDF库。⚖️ 适合谁不适合谁适合想收藏论文的学生、攒资料的职场人、任何想把可预览文档离线读的人——只要文档在官网上有免费预览它就能干活。不适合收费才能预览的文档它拿到的只有官网允许免费看的那部分想要付费全文它帮不上你付费内容也建议走官方渠道PPT类文档暂不支持另外没有批量模式一个编号跑一次多份文档得排队来。如果你手头正存着一份Book118文档想离线看今晚就可以照上面试一次一个编号、一条命令PDF落在out文件夹里。要是哪天预览接口改版导致解析失败先去看下项目的issues——这类小工具用久了总要偶尔维护一下。【免费下载链接】book118-downloader基于java的book118文档下载器项目地址: https://gitcode.com/gh_mirrors/bo/book118-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考