失眠网,内容丰富有趣,生活中的好帮手!
失眠网 > php抓取html元素内容 采集网页

php抓取html元素内容 采集网页

时间:2020-01-22 08:27:16

相关推荐

php抓取html元素内容 采集网页

网页抓取就像搜索引擎一个可以去自动抓取其它服务器上的内容了,下面我整理的几个php常用做法,大家一起来看看.

抓取某一个网页中的内容,需要对DOM树进行解析,找到指定节点后,再抓取我们需要的内容,过程有点繁琐,LZ总结了几种常用的、易于实现的网页抓取方式,如果熟悉JQuery选择器,这几种框架会相当简单.

一、Ganon

项目地址:/p/ganon/

文档:/p/ganon/w/list

测试:抓取我的网站首页所有class属性值是focus的div元素,并且输出class值class, "

n";

}

二、phpQuery

项目地址:/p/phpquery/

文档:/p/phpquery/wiki/Manual

测试:抓取我网站首页的article标签元素,然后出书其下h2标签的html值find(‘h2’)->html()."

";

}

三、Simple-Html-Dom

项目地址:/

文档:/manual.htm

测试:抓取我网站首页的所有链接find(‘img’) as $element)

// echo $element->src . ‘’;

//找到所有链接

foreach($html->find(‘a’) as $element)

echo $element->href . ‘’;

四、Snoopy

项目地址:/p/phpquery/

文档:/p/phpquery/wiki/Manual

测试:抓取我的网站首页

fetch($url); //获取所有内容echo $snoopy->results; //显示结果// echo $snoopy->fetchtext ;//获取文本内容(去掉html代码)// echo $snoopy->fetchlinks($url) ;//获取链接// $snoopy->fetchform ;//获取表单

五、手动编写爬虫

如果编写能力ok,可以手写一个网页爬虫,实现网页抓取,网上有千篇一律的介绍此方法的文章,LZ就不赘述了,有兴趣了解的,可以百度 php 网页抓取.

本文地址:

相关资源:php抓取html元素内容 采集网页

如果觉得《php抓取html元素内容 采集网页》对你有帮助,请点赞、收藏,并留下你的观点哦!

本内容不代表本网观点和政治立场,如有侵犯你的权益请联系我们处理。
网友评论
网友评论仅供其表达个人看法,并不表明网站立场。