php清理word产生的html的函数
说明:
使用FCKedior或ueditor时,从word中粘贴过来的,会产生好多额外的标签。
本节分享一例代码,用于清除word产生的html代码。
例子:
<?php /** * 清理word产生的html * by www.jbxue.com */ function strip_word_html($text, $allowed_tags = '<b><i><sup><sub><em><strong><u><br>') { mb_regex_encoding('UTF-8'); $search = array('/‘/u', '/’/u', '/“/u', '/”/u', '/—/u'); $replace = array('\'', '\'', '"', '"', '-'); $text = preg_replace($search, $replace, $text); $text = html_entity_decode($text, ENT_QUOTES, 'UTF-8'); if(mb_stripos($text, '/*') !== FALSE){ $text = mb_eregi_replace('#/\*.*?\*/#s', '', $text, 'm'); } $text = preg_replace(array('/<([0-9]+)/'), array('< $1'), $text); $text = strip_tags($text, $allowed_tags); $text = preg_replace(array('/^\s\s+/', '/\s\s+$/', '/\s\s+/u'), array('', '', ' '), $text); $search = array('#<(strong|b)[^>]*>(.*?)</(strong|b)>#isu', '#<(em|i)[^>]*>(.*?)</(em|i)>#isu', '#<u[^>]*>(.*?)</u>#isu'); $replace = array('<b>$2</b>', '<i>$2</i>', '<u>$1</u>'); $text = preg_replace($search, $replace, $text); $num_matches = preg_match_all("/\<!--/u", $text, $matches); if($num_matches){ $text = preg_replace('/\<!--(.)*--\>/isu', '', $text); } return $text; }
您可能感兴趣的文章:
php读取word\pdf等文档内容保存到网页中
php清理word产生的html的函数
使用jQuery的将桌面应用程序引入浏览器
php生成word最简单的例子
php导出word文件的简单例子
php错误级别常量有哪些?
php导出word格式文档的实例代码
php生成word文档(读取数据库)
php 导出word文档的简单示例
php生成word文档的例子