php截取字符串之截取utf8或gbk编码的中英文字符串示例_PHP教程
程序员文章站
2022-05-31 16:06:38
...
微博的发言有字数限制,其计数方式是,中文算2个,英文算1个,全角字符算2个,半角字符算1个。
php中自带strlen是返回的字节数,对于utf8编码的中文返回时3个,不满足需求。
mb_strlen 可以根据字符集计算长度,比如utf8的中文计数为1,但这不符合微博字数限制需求,中文必须计算为2才可以。
google了下,找到一个discuz中截取各种编码字符的类,改造了下,已经测试通过.其中参数$charset 只支持gbk与utf-8。
$a = "s@@你好";
var_dump(strlen_weibo($a,'utf-8'));
function strlen_weibo($string, $charset='utf-8')
{
$n = $count = 0;
$length = strlen($string);
if (strtolower($charset) == 'utf-8')
{
while ($n {
$currentByte = ord($string[$n]);
if ($currentByte == 9 ||
$currentByte == 10 ||
(32 {
$n++;
$count++;
} elseif (194 {
$n += 2;
$count += 2;
} elseif (224 {
$n += 3;
$count += 2;
} elseif (240 {
$n += 4;
$count += 2;
} elseif (248 {
$n += 5;
$count += 2;
} elseif ($currentByte == 252 || $currentByte == 253)
{
$n += 6;
$count += 2;
} else
{
$n++;
$count++;
}
if ($count >= $length)
{
break;
}
}
return $count;
} else
{
for ($i = 0; $i {
if (ord($string[$i]) > 127)
{
$i++;
$count++;
}
$count++;
}
return $count;
}
}
php中自带strlen是返回的字节数,对于utf8编码的中文返回时3个,不满足需求。
mb_strlen 可以根据字符集计算长度,比如utf8的中文计数为1,但这不符合微博字数限制需求,中文必须计算为2才可以。
google了下,找到一个discuz中截取各种编码字符的类,改造了下,已经测试通过.其中参数$charset 只支持gbk与utf-8。
复制代码 代码如下:
$a = "s@@你好";
var_dump(strlen_weibo($a,'utf-8'));
结果输出为8,其中字母s计数为1,全角@计数为2,半角@计数为1,两个中文计数为4。源码如下:
复制代码 代码如下:
function strlen_weibo($string, $charset='utf-8')
{
$n = $count = 0;
$length = strlen($string);
if (strtolower($charset) == 'utf-8')
{
while ($n {
$currentByte = ord($string[$n]);
if ($currentByte == 9 ||
$currentByte == 10 ||
(32 {
$n++;
$count++;
} elseif (194 {
$n += 2;
$count += 2;
} elseif (224 {
$n += 3;
$count += 2;
} elseif (240 {
$n += 4;
$count += 2;
} elseif (248 {
$n += 5;
$count += 2;
} elseif ($currentByte == 252 || $currentByte == 253)
{
$n += 6;
$count += 2;
} else
{
$n++;
$count++;
}
if ($count >= $length)
{
break;
}
}
return $count;
} else
{
for ($i = 0; $i {
if (ord($string[$i]) > 127)
{
$i++;
$count++;
}
$count++;
}
return $count;
}
}
下一篇: RedHat升级Python到2.7.6
推荐阅读
-
PHP指定截取字符串中的中英文或数字字符的实例分享
-
php截取字符串之截取utf8或gbk编码的中英文字符串示例
-
PHP指定截取字符串中的中英文或数字字符的实例分享
-
PHP指定截取字符串中的中英文或数字字符的实例分享,_PHP教程
-
支持中文和其他编码的php截取字符串函数分享_PHP教程
-
PHP 截取字符串 分别适合GB2312和UTF8编码情况_PHP教程
-
php截取字符串之截取utf8或gbk编码的中英文字符串示例_PHP教程
-
支持中文和其他编码的php截取字符串函数分享_PHP教程
-
支持中文和其他编码的php截取字符串函数分享(截取中文字符串)_PHP教程
-
PHP指定截取字符串中的中英文或数字字符的实例分享_php实例