如何检查字符串的字符串?

ZA.*_*ZA. 13 php string character-encoding

如何检查字符串的字符集是否为UTF8?

sou*_*rge 33

不要重新发明轮子.该任务有一个内置函数:mb_check_encoding().

mb_check_encoding($string, 'UTF-8');
Run Code Online (Sandbox Code Playgroud)

  • @CMCDragonkai如果您的数据是多字节格式(如UTF-8),您一定要安装PHP扩展,它提供了正确操作输入的功能.例如,如果在UTF-8字符串上使用`strlen`,如果输入包含非ASCII字符,则会得到错误的长度. (2认同)

Ste*_*rig 15

只是旁注:

您无法确定给定的字符串是否以UTF-8编码.您只能确定给定的字符串是否最终以UTF-8编码.请在此处查看相关问题:

不能检测一个给定字符串(或字节序列)是UTF-8编码的文本,例如每个系列UTF-8的八位位组也有效(如果无意义)系列的Latin-1的(或一些其它的编码)字节.然而,并非每个有效的Latin-1八位字节系列都是有效的UTF-8系列.


ZA.*_*ZA. 7

function is_utf8($string) {   
return preg_match('%^(?:  
[\x09\x0A\x0D\x20-\x7E] # ASCII  
| [\xC2-\xDF][\x80-\xBF] # non-overlong 2-byte  
| \xE0[\xA0-\xBF][\x80-\xBF] # excluding overlongs  
| [\xE1-\xEC\xEE\xEF][\x80-\xBF]{2} # straight 3-byte  
| \xED[\x80-\x9F][\x80-\xBF] # excluding surrogates  
| \xF0[\x90-\xBF][\x80-\xBF]{2} # planes 1-3  
| [\xF1-\xF3][\x80-\xBF]{3} # planes 4-15  
| \xF4[\x80-\x8F][\x80-\xBF]{2} # plane 16  
)*$%xs', $string);   
Run Code Online (Sandbox Code Playgroud)

}

我检查过.此功能有效.


nik*_*org 6

更好的是,使用上述两种解决方案.

function isUtf8($string) {
    if (function_exists("mb_check_encoding") && is_callable("mb_check_encoding")) {
        return mb_check_encoding($string, 'UTF8');
    }

    return preg_match('%^(?:
          [\x09\x0A\x0D\x20-\x7E]            # ASCII
        | [\xC2-\xDF][\x80-\xBF]             # non-overlong 2-byte
        |  \xE0[\xA0-\xBF][\x80-\xBF]        # excluding overlongs
        | [\xE1-\xEC\xEE\xEF][\x80-\xBF]{2}  # straight 3-byte
        |  \xED[\x80-\x9F][\x80-\xBF]        # excluding surrogates
        |  \xF0[\x90-\xBF][\x80-\xBF]{2}     # planes 1-3
        | [\xF1-\xF3][\x80-\xBF]{3}          # planes 4-15
        |  \xF4[\x80-\x8F][\x80-\xBF]{2}     # plane 16
    )*$%xs', $string);

} 
Run Code Online (Sandbox Code Playgroud)

  • 调用function_exists()和is_callable()都是多余的,你可以跳过其中一个.但由于is_callable()旨在检查参数是否是有效的回调(请参阅下面的链接),我将使用function_exists()使其更具可读性.链接回调伪类型:http://php.net/manual/en/language.pseudo-types.php#language.types.callback (2认同)
  • @JDelage因为它是扩展程序(php.net/manual/en/book.mbstring.php)的一部分,不能保证始终存在. (2认同)