为了账号安全,请及时绑定邮箱和手机立即绑定

PHP去除BOM头

标签:
PHP

BOM: Byte Order Mark
UTF-8 BOM又叫UTF-8 签名,其实UTF-8 的BOM对UFT-8没有作用,是为了支援UTF-16,UTF-32才加上的BOM,BOM签名的意思就是告诉编辑器当前文件采用何种编码,方便编辑器识别,但是BOM虽然在编辑器中不显示,但是会产生输出,就像多了一个空行,


如果您在修改任何PHP文件後发生:

* 不能登入或者不能登出; * 页顶出现一条空白; * 页顶出现错误警告; * 其它不正常的情况。


则多半是编辑器的问题。

本程序采用UTF-8编码。现在几乎所有的文本编辑软件都可以显示并编辑UTF-8编码的文件。但是很遗憾,其中很多软件的表现并不理想。

类似WINDOWS自带的记事本等软件,在保存一个以UTF-8编码的文件时,会在文件开始的地方插入三个不可见的字符(0xEF 0xBB 0xBF,即BOM)。它是一串隐藏的字符,用于让记事本等编辑器识别这个文件是否以UTF-8编码。对于一般的文件,这样并不会产生什么麻烦。但对于 PHP来说,BOM是个大麻烦。

PHP并不会忽略BOM,所以在读取、包含或者引用这些文件时,会把BOM作为该文件开头正文的一部分。根据嵌入式语言的特点,这串字符将被直接执行(显示)出来。由此造成即使页面的 top padding 设置为0,也无法让整个网页紧贴浏览器顶部,因为在html一开头有这3个字符呢!

最大的麻烦还不是这个。受COOKIE送出机制的限制,在这些文件开头已经有BOM的文件中,COOKIE无法送出(因为在COOKIE送出前PHP已经送出了文件头),所以登入和登出功能失效。一切依赖COOKIE、SESSION实现的功能全部无效。

因此,在编辑、更改任何文本文件时,请务必使用不会乱加BOM的编辑器。Linux下的编辑器应该都没有这个问题。WINDOWS下,请勿使用记事本等编辑器。推荐的编辑器是: Editplus 2.12版本以上; EmEditor; UltraEdit(需要取消‘添加BOM’的相关选项); Dreamweaver(需要取消‘添加BOM’的相关选项) 等。

对于已经添加了BOM的文件,要取消的话,可以用以上编辑器另存一次。(Editplus需要先另存为gb,再另存为UTF-8。) ,以下是程序解决方案:


<?php

header('content-Type: text/html; charset=utf-8');

if(isset($_GET['dir'])){ //设置文件目录,如果没有设置,则自动设置为当前文件所在目录

   $basedir=$_GET['dir'];

}else{

   $basedir='.';

}

$auto=1;/*设置为1标示检测BOM并去除,设置为0标示只进行BOM检测,不去除*/


echo '当前查找的目录为:'.$basedir.'当前的设置是:';

echo $auto?'检测文件BOM同时去除检测到BOM文件的BOM<br />':'只检测文件BOM不执行去除BOM操作<br />';


checkdir($basedir);

function checkdir($basedir){

   if($dh=opendir($basedir)){

       while (($file=readdir($dh)) !== false){

           if($file != '.' && $file != '..'){

               if(!is_dir($basedir.'/'.$file)){

                   echo '文件: '.$basedir.'/'.$file .checkBOM($basedir.'/'.$file).' <br>';

               }else{

                   $dirname=$basedir.'/'.$file;

                   checkdir($dirname);

               }

           }

       }

       closedir($dh);

   }

}

function checkBOM($filename){

   global $auto;

   $contents=file_get_contents($filename);

   $charset[1]=substr($contents,0,1);

   $charset[2]=substr($contents,1,1);

   $charset[3]=substr($contents,2,1);

   if(ord($charset[1])==239 && ord($charset[2])==187 && ord($charset[3])==191){

       if($auto==1){

           $rest=substr($contents,3);

           rewrite($filename,$rest);

           return (' <font color=red>找到BOM并已自动去除</font>');

       }else{

           return (' <font color=red>找到BOM</font>');

       }

   }else{

       return (' 没有找到BOM');

   }

}

function rewrite($filename,$data){

   $filenum=fopen($filename,'w');

   flock($filenum,LOCK_EX);

   fwrite($filenum,$data);

   fclose($filenum);

}/*将以上代码保存为后缀为php的文件放到需要去除bom的文件目录里面,然后运行该php文件,将会对该目录以及该目录所有的子目录下的文件进行bom检查并去除bom,运行结果页面如下:

本文转载自: PHP程序员笔记(http://www.phpernote.com/)

详细出处参考:http://www.phpernote.com/php-string/133.html -->*/

?>


点击查看更多内容
TA 点赞

若觉得本文不错,就分享一下吧!

评论

作者其他优质文章

正在加载中
  • 推荐
  • 评论
  • 收藏
  • 共同学习,写下你的评论
感谢您的支持,我会继续努力的~
扫码打赏,你说多少就多少
赞赏金额会直接到老师账户
支付方式
打开微信扫一扫,即可进行扫码打赏哦
今天注册有机会得

100积分直接送

付费专栏免费学

大额优惠券免费领

立即参与 放弃机会
意见反馈 帮助中心 APP下载
官方微信

举报

0/150
提交
取消