PHP - 如何解析HTML文件
有一个开源的PHP库“PHP Simple HTML DOM Parser”,其官方网址为http://simplehtmldom.sourceforge.net/,它可以将HTML文件解析为DOM模型,并且其查找DOM对象的语法类似jQuery,使用很方便,具体用法到官网看帮助。
对于中文网页,如果编码不是UTF-8的,则需要采用如下代码转换:
$info = file_get_contents("http://www.siluke.com/0/78/78773/");
$info = iconv("gbk", "utf-8//IGNORE", $info);
$dom = str_get_html($info);
就是先用file_get_contents()得到页面内容,再用iconv()转换编码,最后用str_get_html()生成DOM树。声明:本站所有文章资源内容,如无特殊说明或标注,均为采集网络资源。如若本站内容侵犯了原著者的合法权益,可联系本站删除。