java通过url读取远程数据并保持到本地-伙伴云

java通过url读取远程数据并保持到本地

网友投稿 1146 2025-03-31

前几天老姐突然告诉我，她在JD上买了本电子图书，然后买完发现，只能在线或者使用它自己的阅读器看，很不方便，让我给想想办法。

然后我就开始琢磨，最开始，我直接使用Acrobat Reader打开，发现只有目录，没有其他，而且页面上面的都存在，我想可能在真正的内容上增加了一块蒙版，只能有"钥匙"的人可以过滤它，要破解别人的编辑器，短时间肯定是不行的，网上也有很多人想到使用自动化脚本去自动对官方阅读器截图，但是我发现，截图不是一页一页的，这就很懵逼了。最后只能通过在线阅读这条线来想办法。

这个办法和网友的类似，都是保存为图片，然后通过pdf工具制作成pdf。

在线阅读我惊奇发现，在线文档真好，一页一张图片，它已经给你做好，只是每次只更新出当前页的前后几张，其他的会被清除。到这里，思路就有了：

跳转到第n页

拉取刷新出来的额图片路径

保存图片路径到缓存(我使用的是redis)

通过网络工具类，将缓存中的图片地址全部下载到本地本次为图片

将图片通过pdf工作转为pdf

第1步到第3步需要重复，可以使用自动工具和脚本来实现。

第4步写个控制器就可以了，最简单的java接口就行。

第5步直接网上在线服务就可以实现。

java通过url读取远程数据并保持到本地

为什么需要先缓存在下载咧，这里涉及到一个效率与图片去重和过滤的问题，因为每次调整后获取的图片可能有重复的，存在redis的map中，自动就去重了；也是为了避免一边获取图片路径，一边下载中途异常退出等任务不能正常执行完毕等问题。然后脚本获取路径，后保存到自己的服务器，唯一的问题可能就是跨域的问题。结果发现还是少了几张图，这样就体会出使用缓存的好处了，可以直接通过代码验证少了那几张图，不用去检查jpg文件，少的文件个位数，最后通过手动补全了。

通过这种方式得到的图片，唯一缺陷就是带有"JD读书"字样和图片分辨率不是很高，字体好像带点毛脚。有强迫症或者追求高品质的，就使用官方阅读器吧，个人看了蛮清晰的，是文档，不是图片！！！

下面附上java通过URL获取网络数据保存到本地的代码。

public class HttpURLConnectionUtil {// 通过get请求得到读取器响应数据的数据流public static InputStream getInputStreamByGet(String url) { try { HttpURLConnection conn = (HttpURLConnection) new URL(url) .openConnection(); conn.setReadTimeout(5000); conn.setConnectTimeout(5000); conn.setRequestMethod("GET"); if (conn.getResponseCode() == HttpURLConnection.HTTP_OK) { InputStream inputStream = conn.getInputStream(); return inputStream; } } catch (IOException e) { e.printStackTrace(); } return null; }// 将服务器响应的数据流存到本地文件public static void saveData(InputStream is, File file) { try (BufferedInputStream bis = new BufferedInputStream(is); BufferedOutputStream bos = new BufferedOutputStream( new FileOutputStream(file));) { byte[] buffer = new byte[1024]; int len = -1; while ((len = bis.read(buffer)) != -1) { bos.write(buffer, 0, len); bos.flush(); } } catch (IOException e) { e.printStackTrace(); } } }

调用：

Set imgNumber = (Set) redisTemplate.opsForHash().keys(MAP_KEY); imgNumber.stream().forEach(e->{ String url = (String) redisTemplate.opsForHash().get(MAP_KEY,e); String fileName = e+".jpg"; File file = new File("E:\\pdf图片\\", fileName); InputStream inputStream = HttpURLConnectionUtil .getInputStreamByGet(url); HttpURLConnectionUtil.saveData(inputStream, file); });

此方法只适应已经购买了的电子书，未购买的不适用。建议还是到正规网站或书店购买，支持正版，尊重知识。

开发者编程语言

RPA 实战：让小姐姐填满你的硬盘(上)

1146 2025-03-31

java通过url读取远程数据并保持到本地

RPA 实战：让小姐姐填满你的硬盘(上)

[华为云在线课程][Shell脚本编程基础][第二章Shell脚本语言的基本用法][1基本结构][学习笔记]

JSR - 133 都解决了哪些问题？

推荐文章

企业生产管理是什么，企业生产管理软件

进盘点进销存软件排行榜前十名

进销存系统哪个简单好用？进销存系统优点

工厂生产管理（工厂生产管理流程及制度）

生产管理软件，机械制造业生产管理，制造业生产过程管理软件

进销存软件和ERP有什么区别？进销存与erp软件理解

进销存如何进行库存管理

如何利用excel制作销售订单管理系统？

数据库订单管理系统有哪些功能？数据库订单管理系统怎么设计？

什么是数据库管理系统？

最近发表

热评文章

零代码开发是什么？2022低代码平台排行榜">零代码开发是什么？2022低代码平台排行榜

进销存库存管理 系统（智慧进销存）">智能进销存库存管理系统（智慧进销存）

在线文档哪家强？8款在线文档编辑软件推荐">在线文档哪家强？8款在线文档编辑软件推荐

WPS2016怎么绘制简单的价格表?

进销存库存管理盘点">简单进销存库存管理盘点

系统的功能有哪些？餐饮服务系统的构成及工作程序">连锁餐饮管理系统的功能有哪些？餐饮服务系统的构成及工

友情链接

java通过url读取远程数据并保持到本地

微信扫一扫：分享

推荐文章

最近发表

热评文章

零代码开发是什么？2022低代码平台排行榜">零代码开发是什么？2022低代码平台排行榜

进销存库存管理系统（智慧进销存）">智能进销存库存管理系统（智慧进销存）

在线文档哪家强？8款在线文档编辑软件推荐">在线文档哪家强？8款在线文档编辑软件推荐

进销存库存管理盘点">简单进销存库存管理盘点

系统的功能有哪些？餐饮服务系统的构成及工作程序">连锁餐饮管理系统的功能有哪些？餐饮服务系统的构成及工

友情链接