用httpclient或者htmlunit解析这个网页是无法获取到内容,
http://www.hfr.cc/forum.php?mod=viewthread&tid=88379&extra=page%3D1
这个帖子是英文的,如果是中文的就能获取到主贴的内容,
有谁知道这是为什么,有什么方法可以解决的吗?
用httpclient或者htmlunit解析这个网页是无法获取到内容
- 写回答
- 好问题 0 提建议
- 追加酬金
- 关注问题
- 邀请回答
-
1条回答
- ChatGPTᴼᴾᴱᴺᴬᴵ 2023-02-28 13:30关注
该回答引用ChatGPT
可能是因为该网站的内容是动态生成的,而不是静态的。许多网站使用 JavaScript 和 AJAX 技术动态生成页面内容,这使得使用 HttpClient 或 HtmlUnit 等工具很难从页面中提取内容。这些工具只能获取页面的初始 HTML 代码,而无法获取动态生成的内容。
解决此问题的方法之一是使用一个支持 JavaScript 的爬虫框架,例如 Selenium 或 PhantomJS。这些框架可以模拟浏览器行为,使您能够获取页面的完整内容,包括动态生成的内容。
另一个解决方法是直接使用该网站的 API 接口,如果该网站提供 API 接口,那么您可以通过 API 接口获取所需的数据。这是一种更加可靠和有效的方法,因为 API 接口通常是为了提供可靠和可重复的数据访问而设计的。
解决 无用评论 打赏 举报
悬赏问题
- ¥15 微信公众号自制会员卡没有收款渠道啊
- ¥15 stable diffusion
- ¥100 Jenkins自动化部署—悬赏100元
- ¥15 关于#python#的问题:求帮写python代码
- ¥20 MATLAB画图图形出现上下震荡的线条
- ¥15 关于#windows#的问题:怎么用WIN 11系统的电脑 克隆WIN NT3.51-4.0系统的硬盘
- ¥15 perl MISA分析p3_in脚本出错
- ¥15 k8s部署jupyterlab,jupyterlab保存不了文件
- ¥15 ubuntu虚拟机打包apk错误
- ¥199 rust编程架构设计的方案 有偿