前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >php中删除html标签和标签内内容的方法

php中删除html标签和标签内内容的方法

作者头像
沈唁
发布2018-05-24 15:41:28
5.3K0
发布2018-05-24 15:41:28
举报
文章被收录于专栏:沈唁志沈唁志

不少人去扒别人家的网站文章,我是指那种批量式采集的压根不看内容的,少不了都会用到删除 html 标签的函数,这里介绍 3 种不同用途上的方法

$str='<div><p>这里是 p 标签</p><img src="" alt="这里是 img 标签"><a href="">这里是 a 标签</a><br></div>';

1:删除全部或者保留指定 html 标签

php 自带的函数 strip_tags 即可满足要求,

使用方法:strip_tags(string,allow);

string:需要处理的字符串;

allow:需要保留的指定标签,可以写多个;

echo strip_tags($str,'<p><a>');

//输出:<p>这里是 p 标签</p><a href="">这里是 a 标签</a>

此函数的优点是简单粗暴,但是缺点也很明显,如果有一大堆标签,而我只是想删除指定的某一个,那要写很多需要保留的标签,所以有了第二个方法

2:删除指定的 html 标签

使用方法:strip_html_tags($tags,$str);

$tags:需要删除的标签(数组格式)

$str:需要处理的字符串;

function strip_html_tags($tags,$str){
    $html=array();
    foreach ($tags as $tag) {
        $html[]="/(<(?:\/".$tag."|".$tag.")[^>]*>)/i";
    }
    $data=preg_replace($html, '', $str);
    return $data;
}
echo strip_html_tags(array('p','img'),$str);
//输出:<div>这里是 p 标签<a href="">这里是 a 标签</a><br></div>;

3:删除标签和标签的内容

使用方法:strip_html_tags($tags,$str);

$tags:需要删除的标签(数组格式)

$str:需要处理的字符串;

function strip_html_tags($tags,$str){
    $html=array();
    foreach ($tags as $tag) {
        $html[]='/<'.$tag.'.*?>[\s|\S]*?<\/'.$tag.'>/';
        $html[]='/<'.$tag.'.*?>/';
    }
    $data=preg_replace($html,'',$str);
    return $data;
}
echo strip_html_tags(array('a','img'),$str);
//输出<div><p>这里是 p 标签</p><br></div>

很多网站文章里面会带上网站名和链接,比如<a href=”[https://qq52o.me/”>](https://qq52o.me/)沈唁志</a>;这个函数就是专治这种,别拿这个函数采集本站啊,不然保证不打死你。

4:终极函数,删除指定标签;删除或者保留标签内的内容;

使用方法:strip_html_tags($tags,$str,$content);

$tags:需要删除的标签(数组格式)

$str:需要处理的字符串;

$ontent:是否删除标签内的内容 0 保留内容 1 不保留内容

/**
 * 删除指定标签
 * @param array $tags     删除的标签  数组形式
 * @param string $str     html 字符串
 * @param bool $content   true 保留标签的内容 text
 * @return mixed
 */
function stripHtmlTags($tags, $str, $content = true)
{
    $html = [];
    // 是否保留标签内的 text 字符
    if($content){
        foreach ($tags as $tag) {
            $html[] = '/(<' . $tag . '.*?>(.|\n)*?<\/' . $tag . '>)/is';
        }
    }else{
        foreach ($tags as $tag) {
            $html[] = "/(<(?:\/" . $tag . "|" . $tag . ")[^>]*>)/is";
        }
    }
    $data = preg_replace($html, '', $str);
    return $data;
}
//输出<div><p>这里是 p 标签</p><img src="" alt="这里是 img 标签"><br></div>;

前面扯了那么多,其实最后这个函数才是干货,一口气搞定各种标签删除的疑难杂症不费劲。

沈唁志|一个PHPer的成长之路! 原创文章采用CC BY-NC-SA 4.0协议进行许可,转载请注明:转载自:php中删除html标签和标签内内容的方法

本文参与 腾讯云自媒体分享计划,分享自作者个人站点/博客。
原始发表:2017-10-21,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 作者个人站点/博客 前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体分享计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档