天天看点

在php开发过程中去除BOM头的方法

BOM: Byte Order Mark 

   UTF-8 BOM又叫UTF-8 签名,其实UTF-8 的BOM对UFT-8没有作用,是为了支援UTF-16,UTF-32才加上的BOM,BOM签名的意思就是告诉编辑器当前文件采用何种编码,方便编辑器识别,但是BOM虽然在编辑器中不显示,但是会产生输出,就像多了一个空行,如果您在修改任何PHP文件後发生:

   * 不能登入或者不能登出; 

   * 页顶出现一条空白; 

   * 页顶出现错误警告; 

   * 其它不正常的情况。

则多半是编辑器的问题。

   本程序采用UTF-8编码。现在几乎所有的文本编辑软件都可以显示并编辑UTF-8编码的文件。但是很遗憾,其中很多软件的表现并不理想。

类似WINDOWS自带的记事本等软件,在保存一个以UTF-8编码的文件时,会在文件开始的地方插入三个不可见的字符(0xEF 0xBB 0xBF,即BOM)。它是一串隐藏的字符,用于让记事本等编辑器识别这个文件是否以UTF-8编码。对于一般的文件,这样并不会产生什么麻烦。但对于 PHP来说,BOM是个大麻烦。

   PHP并不会忽略BOM,所以在读取、包含或者引用这些文件时,会把BOM作为该文件开头正文的一部分。根据嵌入式语言的特点,这串字符将被直接执行(显示)出来。由此造成即使页面的 top padding 设置为0,也无法让整个网页紧贴浏览器顶部,因为在html一开头有这3个字符呢!

最大的麻烦还不是这个。受COOKIE送出机制的限制,在这些文件开头已经有BOM的文件中,COOKIE无法送出(因为在COOKIE送出前PHP已经送出了文件头),所以登入和登出功能失效。一切依赖COOKIE、SESSION实现的功能全部无效。

   因此,在编辑、更改任何文本文件时,请务必使用不会乱加BOM的编辑器。Linux下的编辑器应该都没有这个问题。WINDOWS下,请勿使用记事本等编辑器。推荐的编辑器是: Editplus 2.12版本以上; EmEditor; UltraEdit(需要取消‘添加BOM’的相关选项); Dreamweaver(需要取消‘添加BOM’的相关选项) 等。

对于已经添加了BOM的文件,要取消的话,可以用以上编辑器另存一次。(Editplus需要先另存为gb,再另存为UTF-8。)

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

16

17

18

19

20

21

22

23

24

25

26

27

28

29

30

31

32

33

34

35

36

37

38

39

40

41

42

43

44

45

46

47

48

<code>&lt;?php</code>

<code>/*检测并清除BOM*/</code>

<code>if</code><code>(isset(</code><code>$_GET</code><code>[</code><code>'dir'</code><code>])){</code>

<code>    </code><code>$basedir</code><code>=</code><code>$_GET</code><code>[</code><code>'dir'</code><code>];</code>

<code>}</code><code>else</code><code>{</code>

<code>    </code><code>$basedir</code> <code>= </code><code>'.'</code><code>;</code>

<code>}</code>

<code>$auto</code> <code>= 1;</code>

<code>checkdir(</code><code>$basedir</code><code>);</code>

<code>function</code> <code>checkdir(</code><code>$basedir</code><code>){</code>

<code>    </code><code>if</code><code>(</code><code>$dh</code> <code>= opendir(</code><code>$basedir</code><code>)){</code>

<code>        </code><code>while</code><code>((</code><code>$file</code> <code>= readdir(</code><code>$dh</code><code>)) !== false){</code>

<code>            </code><code>if</code><code>(</code><code>$file</code> <code>!= </code><code>'.'</code> <code>&amp;&amp; </code><code>$file</code> <code>!= </code><code>'..'</code><code>){</code>

<code>                </code><code>if</code><code>(!</code><code>is_dir</code><code>(</code><code>$basedir</code><code>.</code><code>"/"</code><code>.</code><code>$file</code><code>)){</code>

<code>                    </code><code>echo</code> <code>"filename: $basedir/$file "</code><code>.checkBOM(</code><code>"$basedir/$file"</code><code>).</code><code>" &lt;br&gt;"</code><code>;</code>

<code>                </code><code>}</code><code>else</code><code>{</code>

<code>                    </code><code>$dirname</code> <code>= </code><code>$basedir</code><code>.</code><code>"/"</code><code>.</code><code>$file</code><code>;</code>

<code>                    </code><code>checkdir(</code><code>$dirname</code><code>);</code>

<code>                </code><code>}</code>

<code>            </code><code>}</code>

<code>        </code><code>}</code><code>//end while</code>

<code>    </code><code>closedir</code><code>(</code><code>$dh</code><code>);</code>

<code>    </code><code>}</code><code>//end if($dh</code>

<code>}</code><code>//end function</code>

<code>function</code> <code>checkBOM(</code><code>$filename</code><code>){</code>

<code>    </code><code>global</code> <code>$auto</code><code>;</code>

<code>    </code><code>$contents</code> <code>= </code><code>file_get_contents</code><code>(</code><code>$filename</code><code>);</code>

<code>    </code><code>$charset</code><code>[1] = </code><code>substr</code><code>(</code><code>$contents</code><code>, 0, 1);</code>

<code>    </code><code>$charset</code><code>[2] = </code><code>substr</code><code>(</code><code>$contents</code><code>, 1, 1);</code>

<code>    </code><code>$charset</code><code>[3] = </code><code>substr</code><code>(</code><code>$contents</code><code>, 2, 1);</code>

<code>    </code><code>if</code><code>(ord(</code><code>$charset</code><code>[1]) == 239 &amp;&amp; ord(</code><code>$charset</code><code>[2]) == 187 &amp;&amp; ord(</code><code>$charset</code><code>[3]) == 191){</code>

<code>        </code><code>if</code><code>(</code><code>$auto</code> <code>== 1){</code>

<code>            </code><code>$rest</code> <code>= </code><code>substr</code><code>(</code><code>$contents</code><code>, 3);</code>

<code>            </code><code>rewrite (</code><code>$filename</code><code>, </code><code>$rest</code><code>);</code>

<code>            </code><code>return</code> <code>"&lt;font color=red&gt;BOM found, automatically removed.&lt;/font&gt;"</code><code>;</code>

<code>        </code><code>}</code><code>else</code><code>{</code>

<code>            </code><code>return</code> <code>(</code><code>"&lt;font color=red&gt;BOM found.&lt;/font&gt;"</code><code>);</code>

<code>        </code><code>}</code>

<code>    </code><code>}</code>

<code>    </code><code>else</code> <code>return</code> <code>(</code><code>"BOM Not Found."</code><code>);</code>

<code>function</code> <code>rewrite(</code><code>$filename</code><code>, </code><code>$data</code><code>){</code>

<code>    </code><code>$filenum</code> <code>= </code><code>fopen</code><code>(</code><code>$filename</code><code>, </code><code>"w"</code><code>);</code>

<code>    </code><code>flock</code><code>(</code><code>$filenum</code><code>, LOCK_EX);</code>

<code>    </code><code>fwrite(</code><code>$filenum</code><code>, </code><code>$data</code><code>);</code>

<code>    </code><code>fclose(</code><code>$filenum</code><code>);</code>

<code>?&gt;</code>

本文转自birdinroom 51CTO博客,原文链接:http://blog.51cto.com/birdinroom/1343945,如需转载请自行联系原作者