当前位置：文江博客话题详情

如何用Java下载一个完整的网页（及其所有内容）？

发布于 2024-08-18 23:13:55 字数 110 浏览 2 评论 0原文

使用 Java，我需要保存一个完整的网页（及其所有内容，如图像、css、javascript 等），就像我们如何使用 HttpClient lib 的“另存为”-->“完整网页”选项一样。我该怎么做？

原文

分享到QQ

分享到微博

如果你对这篇内容有疑问，欢迎到本站社区发帖提问参与讨论，获取更多帮助，或者扫码二维码加入 Web 技术交流群。

发布评论

需要登录才能够评论，你可以免费注册一个本站的账号。

过期以后 2024-08-25 23:13:55

你可以尝试 libcurl java
http://curl.haxx.se/libcurl/java/

你也可以参考这个讨论
curl-equivalent-in-java

回复收藏 0 原文

菩提树下叶撕阳。 2024-08-25 23:13:55

您必须编写一个应用程序来获取 html 文件，对其进行解析并提取所有引用，然后获取通过解析找到的所有文件。

回复收藏 0 原文

南风起 2024-08-25 23:13:55

这并不容易，因为一些 CSS/JS/Images 文件路径可能是“隐藏的”。只需考虑以下示例：

<script type="...">
   document.write("&bla;script" + " type='...' src='" + blahBlah() + "'&bla;" + "&bla;/script&bla;");
</script>

但是，获取页面源代码、在搜索 URL 时进行解析以及下载已建立的 URL 几乎是您可能需要的一切。

It's not so easy because some CSS/JS/Images files paths might be "hidden". Just consider the following example:

<script type="...">
   document.write("&bla;script" + " type='...' src='" + blahBlah() + "'&bla;" + "&bla;/script&bla;");
</script>

However, fetching page source, parsing in the search for URLs and downloading founded URLs is pretty everything you'll probably need.

回复收藏 0 原文

~没有更多了~

关于作者

千鲤

暂无简介

0 文章

0 评论

21 人气

关注发私信

qq_FjTq5B

文章 0 评论 0

关注

18273202778

文章 0 评论 0

关注

WordPress小学生

文章 0 评论 0

关注

〃温暖了心ぐ

文章 0 评论 0

关注

迷乱花海

文章 0 评论 0

关注

niuniu

文章 0 评论 0

友情链接

文江博客

如何用Java下载一个完整的网页（及其所有内容）？

如果你对这篇内容有疑问，欢迎到本站社区发帖提问参与讨论，获取更多帮助，或者扫码二维码加入 Web 技术交流群。

发布评论

评论（3）

关于作者

相关话题

热门标签