转义多字节字符

2 unicode perl escaping utf-8 unicode-escapes

使用Python - 我可以获取一个字符串并使用UTF-8转义的多字节字符返回它:

$ python3 -c 'print("hello ? world".encode("utf-8"))'
b'hello \xe2\x98\xba world'
Run Code Online (Sandbox Code Playgroud)

或unicode逃脱:

$ python3 -c 'print("hello ? world".encode("unicode-escape"))'
b'hello \\u263a world'
Run Code Online (Sandbox Code Playgroud)

Perl可以这样做吗?我试过"quotemeta",但它似乎不是正确的工具:

$ perl -e 'print quotemeta("hello ? world\n");'
hello\ \?\?\?\ world\
Run Code Online (Sandbox Code Playgroud)

mob*_*mob 13

Data::Dumper一方面,可以做到这一点.

use utf8;
use Encode;
use Data::Dumper;
$Data::Dumper::Terse = 1;   # suppress  '$VAR1 = ...' header
$Data::Dumper::Useqq = 1;   # make output printable

print Dumper("hello ? world");
print Dumper(encode("UTF-8","hello ? world"));
Run Code Online (Sandbox Code Playgroud)

输出:

"hello \x{263a} world"
"hello \342\230\272 world"
Run Code Online (Sandbox Code Playgroud)

更新:Data::Dumper模块中的相关功能是qquote,因此您可以跳过设置$Useqq和$Terse:

use utf8;
use Encode;
use Data::Dumper;

print Data::Dumper::qquote("hello ? world"), "\n";
print Data::Dumper::qquote(encode("UTF-8","hello ? world")), "\n";
Run Code Online (Sandbox Code Playgroud)