php删除html标签和标签内的内容

2020-03-04 网页编程网 网页编程网

总结批量采集删除html标签函数。

原采集的内容如下：

$str='<div><p>这里是p标签</p><img src="" alt="这里是img标签"><a href="">这里是a标签</a><br></div>';

1.删除全部或者保留指定html标签

自带的函数strip_tags即可满足要求。

使用方法：

strip_tags(string,allow)；

string：需要处理的字符串；

allow：需要保留的指定标签，可以写多个。

优点是简单粗暴；缺点是如果有一大堆标签，而只是想删除指定的某一个；那要写很多需要保留的标签。

echo strip_tags($str,'<p><a>');
//输出：
//<p>这里是p标签</p><a href="">这里是a标签</a>

2.删除指定的html标签

使用方法：

strip_html_tags($tags,$str)；

$tags：需要删除的标签(数组格式)；

$str：需要处理的字符串。

function strip_html_tags($tags,$str){
$html=array();
foreach ($tags as $tag) {
$html[]="/(<(?:\/".$tag."|".$tag.")[^>]*>)/i";
}
$data=preg_replace($html, '', $str);
return $data;
}
echo strip_html_tags(array('p','img'),$str);
//输出：
//<div>这里是p标签<a href="">这里是a标签</a><br></div>;

3.删除标签和标签的内容

使用方法：

strip_html_tags($tags,$str)；

$tags：需要删除的标签(数组格式)；

$str：需要处理的字符串。

很多网站文章里面会带上网站名和链接，比如<a href="http://www.xxxx.com">xxxxx博客</a>，此函数就是专治。

function strip_html_tags($tags,$str){
$html=array();
foreach ($tags as $tag) {
$html[]='/<'.$tag.'.*?>[\s|\S]*?<\/'.$tag.'>/';
$html[]='/<'.$tag.'.*?>/';
}
$data=preg_replace($html,'',$str);
return $data;
}
echo strip_html_tags(array('a','img'),$str);
//输出：
//<div><p>这里是p标签</p><br></div>

4.删除指定标签；删除或者保留标签内的内容

使用方法：

strip_html_tags($tags,$str,$content)；

$tags：需要删除的标签(数组格式)；

$str：需要处理的字符串；

$content：是否删除标签内的内容：0保留内容，1不保留内容。

/**
 * 删除指定标签
 *
 * @param array $tags     删除的标签  数组形式
 * @param string $str     html字符串
 * @param bool $content   true保留标签的内容text
 * @return mixed
 */
function stripHtmlTags($tags, $str, $content = true){
$html = [];
// 是否保留标签内的text字符
if($content){
foreach ($tags as $tag) {
$html[] = '/(<' . $tag . '.*?>(.|\n)*?<\/' . $tag . '>)/is';
}
}else{
foreach ($tags as $tag) {
$html[] = "/(<(?:\/" . $tag . "|" . $tag . ")[^>]*>)/is";
}
}
$data = preg_replace($html, '', $str);
return $data;
}
//输出：
//<div><p>这里是p标签</p><img src="" alt="这里是img标签"><br></div>;

阅读原文

阅读 5136

123 显示电脑版