我在一页上有一个表格:
<form method="POST" accept-charset="UTF-8" action="index.cgi" name="TestForm">
输入字段“search_string”之一可用于发送西里尔字符,如果发生这种情况,URL 字符串如下所示:
search_string=%41F%2F%424+%41F%41E%414%416%410%420%41A%410+%418%417+%421%412%418%41D
如何将其解码回我发布到的页面上的原始字符串?
正确的解决方案,包括空格:
use open ':std', ':encoding(UTF-8)';
use Encode;
my $escaped = '%41F%2F%424+%41F%41E%414%416%410%420%41A%410+%418%417+%421%412%418%41D';
(my $unescaped = $escaped) =~ s/\+/ /g;
$unescaped =~ s/%([[:xdigit:]]+)/chr hex $1/eg;
print $unescaped;
# П/Ф ПОДЖАРКА ИЗ СВИН
信用去往雷诺·邦普伊斯首先识别这些是前缀为 Unicode 代码点%
.
我想补充一点,问题中的编码方案非常不寻常,我以前没有见过。通常人们会期望字符串П/Ф ПОДЖАРКА ИЗ СВИН
被编码为%D0%9F%2F%D0%A4+%D0%9F%D0%9E%D0%94%D0%96%D0%90%D0%A0%D0%9A%D0%90+%D0%98%D0%97+%D0%A1%D0%92%D0%98%D0%9D
,也就是说,首先将字符编码为 UTF-8,然后对八位字节进行百分比转义。该方案适用于以下答案卡梅隆博士.
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系:hwhale#tublm.com(使用前将#替换为@)