您现在的位置是:网站首页> 编程资料编程资料
phpQuery采集网页实现代码实例_php技巧_
2023-05-25
316人已围观
简介 phpQuery采集网页实现代码实例_php技巧_
前言
平时开发中可能遇到一个问题。采集网页,小偷程序等等。各种花式秀正则的话,虽然能体现出geek,但是我觉得做事却不够优雅。采集到的网页说白了也是DOM,jQuery各种优雅地获取节点。幸好,有这个类库,帮我们解决了这个,那就是phpQuery.
为什么使用phpQuery
phpQuery是基于php5新添加的DOMDocument。而DOMDocument则是专门用来处理html/xml。它提供了强大的xpath选择器及其他很多html/xml操作函数,使得处理html/xml起来非常方便。
尤其对于新手,看到一堆”不知所云”的字符评凑在一起,有种脑袋都要炸了的感觉。如果要分离的对象没有太明显的特征,正则写起来更是麻烦。
学习成本低,jQuery是PHP程序员的标配,那么懂jQuery的话,是可以无缝衔接的,学习成本几乎为0。选择器,节点,节点信息,over
下载地址
https://code.google.com/archive/p/phpquery/downloads(需要翻墙,或者自行百度phpQuery)
实验
既然开始了,那么就做个实验,比如我们要获取SF的所有标签名称https://segmentfault.com/tags,审查元素,得到部分标签属性。负载均衡
Demo
getAttribute("data-original-title"),"
"; }结果

总结
0.网页采集真特么无脑暴力,成功绕过恶心的正则
1.写法参照jQuery
2.体会Dom的思想
3.此类库并非万金油,更适合网页采集
以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持。
相关内容
- 通过PHP的Wrapper无缝迁移原有项目到新服务的实现方法_php实例_
- php计数排序算法的实现代码(附四个实例代码)_php技巧_
- php设计模式之观察者模式实例详解【星际争霸游戏案例】_php实例_
- TP5框架实现上传多张图片的方法分析_php实例_
- thinkphp框架无限级栏目的排序功能实现方法示例_php实例_
- php查看一个变量的占用内存的实例代码_php技巧_
- tp5框架前台无限极导航菜单类实现方法分析_php实例_
- PHP中类与对象功能、用法实例解读_php实例_
- php设计模式之职责链模式实例分析【星际争霸游戏案例】_php实例_
- php设计模式之组合模式实例详解【星际争霸游戏案例】_php实例_
