php mb_substr utf8,php使用mb_substr()解决中文字符串截取乱码问题

PHP 自带几种字符串截取函数,其中常用到的就是 substr 和 mb_substr。前者在处理中文时,GBK 为 2 个长度单位,UTF 为 3 个长度单位,后者指定编码后,一个中文即为 1 个长度单位。

mb_substr用法string mb_substr( string$str, int$start[, int$length[, string$encoding]] );

mb_substr 执行一个多字节安全的substr()操作基础上的字符数。从str的开始位置计算。第一个字符的位置为0。第二个字符的位置是1,依此类推:

str 被截取的母字符串。

start开始位置。

length 返回的字符串的最大长度,如果省略,则截取到str末尾。

encoding 参数为字符编码。如果省略,则使用内部字符编码。

那么我们可以使用一下的代码,来完成这个问题。$mess=mb_substr($message,0,19,'gb2312');

gb2312就是中文的编码格式。

mb_substr处理中英文混合字符串

substr 有时会截 1/3 个中文或半个中文,会显示乱码,相对来说 mb_substr 更适合我们使用。不过有时候 mb_substr 就显得不那么好用了。例如我要显示一个小图片的简要信息,5 个中文正好,超过 5 个就截取前4再加上 “…”,这样处理中文是没问题了,可是处理英文或数字,这样截取就太短了。使用下面这段函数则可以解决这个问题:<?php

/**

* 字符串截取

*

* @author gesion

* @param string $str 原始字符串

* @param int $len 截取长度(中文/全角符号默认为 2 个单位,英文/数字为 1。

* 例如:长度 12 表示 6 个中文或全角字符或 12 个英文或数字)

* @param bool $dot 是否加点(若字符串超过 $len 长度,则后面加 "...")

* @return string

*/

class Onens {

public static function g_substr($str, $len = 12, $dot = true) {

$i = 0;

$l = 0;

$c = 0;

$a = array();

while ($l < $len) {

$t = substr($str, $i, 1);

if (ord($t) >= 224) {

$c = 3;

$t = substr($str, $i, $c);

$l += 2;

} elseif (ord($t) >= 192) {

$c = 2;

$t = substr($str, $i, $c);

$l += 2;

} else {

$c = 1;

$l++;

}

// $t = substr($str, $i, $c);

$i += $c;

if ($l > $len) break;

$a[] = $t;

}

$re = implode('', $a);

if (substr($str, $i, 1) !== false) {

array_pop($a);

($c == 1) and array_pop($a);

$re = implode('', $a);

$dot and $re .= '...';

}

return $re;

}

}

本文原创发布php中文网,转载请注明出处,感谢您的尊重!

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值