常常扒别人网站文章的坑们;我是指那种批量式采集的压根不看内容的,少不了都会用到删除html标签的函数;这里介绍3种不一样用途上的方法;php
$str='<div><p>这里是p标签</p><img src="" alt="这里是img标签"><a href="">这里是a标签</a><br></div>';
1:删除所有或者保留指定html标签
html
php自带的函数strip_tags便可知足要求,数组
使用方法:strip_tags(string,allow);函数
string:须要处理的字符串;网站
allow:须要保留的指定标签,能够写多个;
spa
<?php echo strip_tags($str,'<p><a>'); ?> //输出:<p>这里是p标签</p><a href="">这里是a标签</a>
次函数的优势是简单粗暴,可是缺点也很明显;若是有一大堆标签;而我只是想删除指定的某一个;那要写不少须要保留的标签; 因此有了第二个方法;code
2:删除指定的html标签htm
使用方法:strip_html_tags($tags,$str);ip
$tags:须要删除的标签(数组格式)字符串
$str:须要处理的字符串;
<?php function strip_html_tags($tags,$str){ $html=array(); foreach ($tags as $tag) { $html[]="/(<(?:\/".$tag."|".$tag.")[^>]*>)/i"; } $data=preg_replace($html, '', $str); } echo strip_html_tags(array('p','img'),$str); ?> //输出<div>这里是p标签<a href="">这里是a标签</a><br></div>;
3:删除标签和标签的内容
使用方法:strip_html_tags($tags,$str);
$tags:须要删除的标签(数组格式)
$str:须要处理的字符串;
<?php function strip_html_tags($tags,$str){ $html=array(); foreach ($tags as $tag) { $html[]='/(<'.$tag.'.*?>[\s|\S]*?<\/'.$tag.'>)/'; } $data=preg_replace($html,'',$str); } echo strip_html_tags(array('a','img'),$str); ?> //输出<div><p>这里是p标签</p><img src="" alt="这里是img标签"><br></div>;
不少网站文章里面会带上网站名和连接,好比<a href="http://www.baijunyao.com">白俊遥博客</a>;这个函数就是专治这种; 别拿这个函数采集本站啊;否则保证不打死你;
4:终极函数,删除指定标签;删除或者保留标签内的内容;
使用方法:strip_html_tags($tags,$str,$content);
$tags:须要删除的标签(数组格式)
$str:须要处理的字符串;
$ontent:是否删除标签内的内容 0保留内容 1不保留内容
<?php /** * 删除指定的标签和内容 * @param array $tags 须要删除的标签数组 * @param string $str 数据源 * @param string $content 是否删除标签内的内容 默认为0保留内容 1不保留内容 * @return string */ function strip_html_tags($tags,$str,$content=0){ if($content){ $html=array(); foreach ($tags as $tag) { $html[]='/(<'.$tag.'.*?>[\s|\S]*?<\/'.$tag.'>)/'; } $data=preg_replace($html,'',$str); }else{ $html=array(); foreach ($tags as $tag) { $html[]="/(<(?:\/".$tag."|".$tag.")[^>]*>)/i"; } $data=preg_replace($html, '', $str); } return $data; } echo strip_html_tags(array('a'),$str,1); ?> //输出<div><p>这里是p标签</p><img src="" alt="这里是img标签"><br></div>;
前面扯了那么多;其实最后这个函数才是干货;一口气搞定各类标签删除的疑难杂症不费劲;
别看下面这张截图了;无非带点颜色好看,我主要是拿来凑图当文章封面的;
本文为白俊遥原创文章,转载无需和我联系,但请注明来自白俊遥博客baijunyao.com