要实现php插件QueryList V3采集器的□□功能,首先就是□□□要下载phpQuery.php和QueryList.php,我们使用□□□□的是tp3.2,所以把这❖两个文件□□□□放到如下□□□□图所示的□□□位置:

然后在控□□□制器上,使用vendor('Caiji.phpQuery');vendor('Caiji.QueryList');引入这两◢个文件,然后使用□□□□命名空间use QL\QueryList;引入QueryList类,如下图所○示:
然后使用QueryList::方法名,即可调用QueryList类的方法,如下图所□□□□示,我们来采•集一个网□□址:
$html是我们要采集的一个网址,我们打开这个页面,如下图:
然后查看这个页面的源代码,如下所示:
上面的源□□□代码划红□□□□圈的位置,我们需要□□□□采集的是□□网页的URL,标题,图片三个△参数,这样QueryList采集器的◢规则如下:
$rules = array("url"=>array('.all ul li a','href'),
'title'=>array('.all ul li a .news-wrap p','text'),
'picture'=>array('.img-wrap img','data-echo'));
这个就是□□□在这个页□□面里,获取url,title,picture这三个参□□□数的匹配□□□到符合条□□□件的数组,至于这个□□规则为何□□这样写,可以自行□□□□查看QueryList V3的开发文□□□档,这里不再□□□□赘述,然后使用
$data_list = QueryList::Query($html,$rules)->data;执行采集程序,就能获取到如下数组:

....
这样就可以对数组进行处理了,首先我们注意到这个图片的路径是远程的绝对地址,如果直接存到数据库表中,随时可能因为某种原因打开,所以就需要把图片保存到服务器上,所以需要运用到以下方法:
$file_url 是远程的图片地址,如上面数组的picture的路径,$save_to是服务器上要保存的文件地址,如 $save_to = 'Uploads/caiji/123.jpg';
这样通过$this->dlfile($file_url, $save_to)调用这个方法后即可保存图片,这样图片的地址就能转换成服务器上的相对地址或根目录地址了。
以上是对QueryList V3的实例运□□□□用介绍,其实还有□□□很多比较□□□实用的技●巧没讲,例如内容□□□过滤,获取内容□□乱码如何◆解决等。如果有时●间下次再□□讲一下把□□采集数据☆处理,先采集列□□表页面,再通过列□□□表的链接□□□□采集到文□□□章页面,再把它保★存到数据□□□库中的处□□理过程。