我需要一款爬虫提取一批网页的数据,但网页中有一些内容是Ajax加载的(在Lynx下不显示),像request之类的库根本无法获取数据,所以想请教在脚本执行完之后的才获取页面得方案。 PhantomJS也许可以但太重,而且是命令行工具不是库,感觉直接嵌入系统不太合适。如果没有其它方案的话,也只能试试了。
回复 (3)
R
怎么不是库啊?
参与回复
登录后即可参与回复。登录
我需要一款爬虫提取一批网页的数据,但网页中有一些内容是Ajax加载的(在Lynx下不显示),像request之类的库根本无法获取数据,所以想请教在脚本执行完之后的才获取页面得方案。 PhantomJS也许可以但太重,而且是命令行工具不是库,感觉直接嵌入系统不太合适。如果没有其它方案的话,也只能试试了。
怎么不是库啊?