找我啊

 找回密码
 立即注册

QQ登录

只需一步,快速开始

搜索
热搜: 活动 交友 discuz
查看: 306|回复: 0

php删除html标签和标签内的内容的方法

[复制链接]

1

主题

1

帖子

15

积分

管理员

Rank: 9Rank: 9Rank: 9

积分
15
发表于 2018-9-28 11:24:45 | 显示全部楼层 |阅读模式

经常扒别人网站文章的坑们;
我是指那种批量式采集的压根不看内容的;
少不了都会用到删除html标签的函数;
这里介绍3种不同用途上的方法;
  1. $str='<div><p>这里是p标签</p><img src="" alt="这里是img标签"><a href="">这里是a标签</a><br></div>';
复制代码


1:删除全部或者保留指定html标签
php自带的函数strip_tags即可满足要求,
使用方法:
strip_tags(string,allow);
string:需要处理的字符串;
allow:需要保留的指定标签,可以写多个;
  1. echo strip_tags($str,'<p><a>');

  2. //输出:<p>这里是p标签</p><a href="">这里是a标签</a>
复制代码



此函数的优点是简单粗暴;
但是缺点也很明显;
如果有一大堆标签;
而我只是想删除指定的某一个;
那要写很多需要保留的标签;
所以有了第二个方法;
2:删除指定的html标签
使用方法:strip_html_tags($tags,$str);
$tags:需要删除的标签(数组格式)
$str:需要处理的字符串;

  1. function strip_html_tags($tags,$str){
  2.     $html=array();
  3.     foreach ($tags as $tag) {
  4.         $html[]="/(<(?:\/".$tag."|".$tag.")[^>]*>)/i";
  5.     }
  6.     $data=preg_replace($html, '', $str);
  7.     return $data;
  8. }
  9. echo strip_html_tags(array('p','img'),$str);
  10. //输出:<div>这里是p标签<a href="">这里是a标签</a><br></div>;
复制代码

3:删除标签和标签的内容
使用方法:strip_html_tags($tags,$str);
$tags:需要删除的标签(数组格式)
$str:需要处理的字符串;

  1. function strip_html_tags($tags,$str){
  2.     $html=array();
  3.     foreach ($tags as $tag) {
  4.         $html[]='/<'.$tag.'.*?>[\s|\S]*?<\/'.$tag.'>/';
  5.         $html[]='/<'.$tag.'.*?>/';
  6.     }
  7.     $data=preg_replace($html,'',$str);
  8.     return $data;
  9. }
  10. echo strip_html_tags(array('a','img'),$str);
  11. //输出<div><p>这里是p标签</p><br></div>
复制代码



很多网站文章里面会带上网站名和链接;
比如<a href="http://www.baijunyao.com">白俊遥博客</a>;
这个函数就是专治这种;
别拿这个函数采集本站啊;
不然保证不打死你;
4:终极函数,删除指定标签;删除或者保留标签内的内容;
使用方法:strip_html_tags($tags,$str,$content);
$tags:需要删除的标签(数组格式)
$str:需要处理的字符串;
$ontent:是否删除标签内的内容 0保留内容 1不保留内容
  1. /**
  2. * 删除指定标签
  3. *
  4. * @param array $tags     删除的标签  数组形式
  5. * @param string $str     html字符串
  6. * @param bool $content   true保留标签的内容text
  7. * @return mixed
  8. */
  9. function stripHtmlTags($tags, $str, $content = true)
  10. {
  11.     $html = [];
  12.     // 是否保留标签内的text字符
  13.     if($content){
  14.         foreach ($tags as $tag) {
  15.             $html[] = '/(<' . $tag . '.*?>(.|\n)*?<\/' . $tag . '>)/is';
  16.         }
  17.     }else{
  18.         foreach ($tags as $tag) {
  19.             $html[] = "/(<(?:\/" . $tag . "|" . $tag . ")[^>]*>)/is";
  20.         }
  21.     }
  22.     $data = preg_replace($html, '', $str);
  23.     return $data;
  24. }
  25. //输出<div><p>这里是p标签</p><img src="" alt="这里是img标签"><br></div>;
复制代码

前面扯了那么多;
其实最后这个函数才是干货;
一口气搞定各种标签删除的疑难杂症不费劲;
别看下面这张截图了;
无非带点颜色好看;
我主要是拿来凑图当文章封面的;



回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

QQ|Archiver|手机版|小黑屋|找我啊 ( 沪ICP备17031007号-2 )

GMT+8, 2019-2-22 04:05 , Processed in 0.116764 second(s), 27 queries .

Powered by Discuz! X3.4

© 2001-2017 Comsenz Inc.

快速回复 返回顶部 返回列表