不管用 net::http get 或者用其他方法open url,总是只能得到网页源代码类似的内容,实际动态显示在浏览器上的数据却怎么也得不到,诸位有经验可以分享吗?
如抓取一个javascript函数返回值等
ruby 能够抓取动态网页内容如javascript或者ajax更新的内容?
- 写回答
- 好问题 0 提建议
- 追加酬金
- 关注问题
- 邀请回答
-
2条回答 默认 最新
- Robin2Wu 2009-10-27 17:36关注
我做过一个抓数据的脚本, 代码如何, 是否对你有帮助?
[code="java"]
class ClassName
HOST = "www.xxx.com"
URL = '/xxxx/xxx.php'
TABLE_REGEXP = //m
def http
@http ||= Net::HTTP.start(HOST, 80)
enddef initialize
enddef response
return @response unless @response.nil?
Net::HTTP.start(HOST, 80) do |http|
@response = Iconv.iconv("UTF-8//IGNORE","GB2312//IGNORE", http.get(URL).body).to_s
end
enddef html_table
@html_table ||= response.match(TABLE_REGEXP).to_s
end
endClassName.html_table
[/code]本回答被题主选为最佳回答 , 对您是否有帮助呢?解决 无用评论 打赏 举报
悬赏问题
- ¥15 vs2019中数据导出问题
- ¥20 云服务Linux系统TCP-MSS值修改?
- ¥20 关于#单片机#的问题:项目:使用模拟iic与ov2640通讯环境:F407问题:读取的ID号总是0xff,自己调了调发现在读从机数据时,SDA线上并未有信号变化(语言-c语言)
- ¥20 怎么在stm32门禁成品上增加查询记录功能
- ¥15 Source insight编写代码后使用CCS5.2版本import之后,代码跳到注释行里面
- ¥50 NT4.0系统 STOP:0X0000007B
- ¥15 想问一下stata17中这段代码哪里有问题呀
- ¥15 flink cdc无法实时同步mysql数据
- ¥100 有人会搭建GPT-J-6B框架吗?有偿
- ¥15 求差集那个函数有问题,有无佬可以解决