手机
当前位置:查字典教程网 >编程开发 >php教程 >PHP正确解析UTF-8字符串技巧应用
PHP正确解析UTF-8字符串技巧应用
摘要:在《学习PHP&MYSQL之——字符编码篇(一)》中介绍了Unicode与UTF-8的转换关系,总结了一个UTF-8的编码规则,根据这个编码...

在《学习PHP&MYSQL之——字符编码篇(一)》中介绍了Unicode与UTF-8的转换关系,总结了一个UTF-8的编码规则,根据这个编码规则,写一个UTF-8编码的解析程序,以下是PHP的实现:

复制代码 代码如下:

<?php

/*

程序功能,$str是中英文混合的UTF-8编码字符串,

将此字符串根据UTF-8的编码规则正确的解码并显示。

*/

$str = '今天非常Happy,所有决定去KFC吃可乐鸡翅!!!';

/*

$str 是待截取的字符串

$len 是截取的字符数

*/

function utf8sub($str,$len) {

if($len <= 0){

return '';

}

$offset = 0; // 截取高位字节时的偏移量

$chars = 0; // 截取到的字符数

$res = ''; // 存放截取的结果字符串

while($chars < $len){

// 先取字符串的第一个字节

// 将它转为十进制

// 再转为二进制

$high = ord(substr($str,$offset,1));

// echo '$high='. $high .'<br />';

if($high == null ){ // 如果取出高位为null,证明已经取到末尾,直接break

break;

}

if(($high>>2) === 0x3F){ // 将高位右移2位,和二进制111111比较,相同则取6个字节

// 截取2个字节

$count = 6;

}else if(($high>>3) === 0x1F){ // 将高位右移2位,和二进制11111比较,相同则取5个字节

// 截取3个字节

$count = 5;

}else if(($high>>4) === 0xF){ // 将高位右移2位,和二进制1111比较,相同则取4个字节

// 截取4个字节

$count = 4;

}else if(($high>>5) === 0x7){ // 将高位右移2位,和二进制111比较,相同则取3个字节

// 截取5个字节

$count = 3;

}else if(($high>>6) === 0x3){ // 将高位右移2位,和二进制11比较,相同则取2个字节

// 截取6个字节

$count = 2;

}else if(($high>>7) === 0x0){ // 将高位右移2位,和二进制0比较,相同则取1个字节

$count = 1;

}

// echo '$count='.$count.'<br />';

$res .= substr($str,$offset,$count); // 取出一个字符与$res字符串连接

$chars += 1; // 截取到的字符数+1

$offset += $count; // 截取高位偏移量向后移$count字节

}

return $res;

}

echo utf8sub($str,100);

【PHP正确解析UTF-8字符串技巧应用】相关文章:

PHP脚本的10个技巧(6)

如何使用PHP中的字符串函数

PHP5中MVC结构学习

支持中文的PHP按字符串长度分割成数组代码

php解析字符串里所有URL地址的方法

PHP的十个高级技巧(上中下)第1/3页

PHP脚本的10个技巧(7)

PHP脚本的10个技巧(8)

PHP实现过滤掉非汉字字符只保留中文字符

PHP输出控制功能在简繁体转换中的应用

精品推荐
分类导航