python爬虫中PhantomJS怎样评估代码
这篇文章将为大家详细讲解有关python爬虫中PhantomJS怎样评估代码,小编觉得挺实用的,因此分享给大家做个参考,希望大家阅读完这篇文章后可以有所收获。
在滦州等地区,都构建了全面的区域性战略布局,加强发展的系统性、市场前瞻性、产品创新能力,以专注、极致的服务理念,为客户提供成都网站制作、网站建设 网站设计制作按需设计网站,公司网站建设,企业网站建设,高端网站设计,全网整合营销推广,外贸网站制作,滦州网站建设费用合理。
利用 evaluate 方法我们可以获取网页的源代码。这个执行是 “沙盒式” 的,它不会去执行网页外的 JavaScript 代码。evalute 方法可以返回一个对象,然而返回值仅限于对象,不能包含函数(或闭包)
var url = 'http://www.baidu.com'; var page = require('webpage').create(); page.open(url, function(status) { var title = page.evaluate(function() { return document.title; }); console.log('Page title is ' + title); phantom.exit(); });
以上代码获取了百度的网站标题。
Page title is 百度一下,你就知道
任何来自于网页并且包括来自 evaluate () 内部代码的控制台信息,默认不会显示。 需要重写这个行为,使用 onConsoleMessage 回调函数,示例可以改写成
var url = 'http://www.baidu.com'; var page = require('webpage').create(); page.onConsoleMessage = function (msg) { console.log(msg); }; page.open(url, function (status) { page.evaluate(function () { console.log(document.title); }); phantom.exit(); });
这样的话,如果你用浏览器打开百度首页,打开调试工具的 console,可以看到控制台输出信息。 重写了 onConsoleMessage 方法之后,可以发现控制台输出的结果和我们需要输出的标题都打印出来了。
关于python爬虫中PhantomJS怎样评估代码就分享到这里了,希望以上内容可以对大家有一定的帮助,可以学到更多知识。如果觉得文章不错,可以把它分享出去让更多的人看到。
名称栏目:python爬虫中PhantomJS怎样评估代码
文章网址:http://azwzsj.com/article/gcicec.html