perl 关于Url Encode 和 Url Decode

2023-08-08 22:55•javascript•阅读 3006

对于url中的中文字符，大多数网站都会做编码的处理，这里我们来探讨常用的2中编码和解码在perl中实现。

常用的编码方式有2种，GBK和UTF-8，因此URL编码也使用GBK的URL编码和UTF-8的URL编码。

1：GBK进行URL Encode。

1）先对字符串进行GBK编码。请注意，汉字本身采用的就是GBK编码，因此对于汉字，不应该再使用GBK编码。所以实际上如果是针对URL有汉字的URL进行URL编码，就直接使用URL编码函数即可。

2）然后进行URL编码

}

测试输出：

@# ->[GBK]@# ->[URLencode]%40%23

@# -> [URLencode]%40%23

然后进行URL的GBK解码

解码的过程也要注意，汉字是不是重复使用了GBK解密，代码如下

my $decode = URI::Escape::uri_unescape($_); #汉字编码的url可直接进行这一步

print "$_ ->[URLdecode]$gbkec ->[GBKDecode]$chstr\n";

print "$_ -> [URLdecode]$decode\n";

}

测试输出：

%40%23

%40%23 ->[URLdecode]@# ->[GBKDecode]@#

%40%23 -> [URLdecode]@#

2：UTF-8进行URL编码。

因为汉字采用的是GBK编码，因此不论在URL编码前还是在URL解码后，都需要调用相应函数进行操作。

对于UTF-8的编码和解码，我们使用UTF-8模块中的函数。

如下是编码后又解码的过程：

while(<>){

chomp;

my $utf8str = $_;

utf8::encode($utf8str); #进行UTF-8编码，函数直接操作变量

my $encode = URI::Escape::uri_escape($utf8str); #对已经经过UTF-8编码的对象进行URL编码

print "UTF-8 Encode:[$_] -> [$utf8str] -> [$encode]\n";

my $urldecode = URI::Escape::uri_unescape($encode); #对经过UTF-8编码的URL进行URL解码

my $decode = $urldecode;

utf8::decode($decode); #对经过URL解码后的字符串进行UTF-8解码

print "UTF-8 Decode:[$encode] -> [$urldecode] -> [$decode]\n";

}

测试输出：

测试

UTF-8 Encode:[测试] -> [Â²Ã¢ÃŠÃ”] -> [%C2%B2%C3%A2%C3%8A%C3%94]

UTF-8 Decode:[%C2%B2%C3%A2%C3%8A%C3%94] -> [Â²Ã¢ÃŠÃ”] -> [测试]

总结：大多数国内网站对中文编码都采用GBK，因为这样会少一步编码处理。比如百度，即采用GBK编码。

但是国外网站大多采用UTF-8编码，因为UTF-8相对GBK更广泛。

上一篇 »关于URL编码/javascript/js url 编码，轉
下一篇 »Python encode，方法和decode

perl 关于Url Encode 和 Url Decode

相关推荐

PHP如何将XML转成数组？

JavaScript 解决 url 中的中文乱码问题

php自定义json_encode，和json_decode

PHP中json_encode、json_decode与serialize、unserialize的性能测试

python里面的encode和decode函数

Python3中json的encode和decode

JS/JSP/Java 中 URL/参数 的转义

Java如何进行Base64的编码？Encode与解码

JS/JSP/Java 中 URL/参数的转义