• 设为首页
  • 点击收藏
  • 手机版
    手机扫一扫访问
    迪恩网络手机版
  • 关注官方公众号
    微信扫一扫关注
    公众号

perl关于UrlEncode和UrlDecode

原作者: [db:作者] 来自: [db:来源] 收藏 邀请

对于url中的中文字符,大多数网站都会做编码的处理,这里我们来探讨常用的2中编码和解码在perl中实现。

常用的编码方式有2种,GBK和UTF-8,因此URL编码也使用GBK的URL编码和UTF-8的URL编码。

1:GBK进行URL Encode。

 1)先对字符串进行GBK编码。请注意,汉字本身采用的就是GBK编码,因此对于汉字,不应该再使用GBK编码。所以实际上如果是针对URL有汉字的URL进行URL编码,就直接使用URL编码函数即可。

 2)然后进行URL编码 

}
测试输出:
@# ->[GBK]@# ->[URLencode]%40%23
@# -> [URLencode]%40%23

然后进行URL的GBK解码
解码的过程也要注意,汉字是不是重复使用了GBK解密,代码如下

        my $decode = URI::Escape::uri_unescape($_); #汉字编码的url可直接进行这一步
        print "$_ ->[URLdecode]$gbkec ->[GBKDecode]$chstr\n";
        print "$_ -> [URLdecode]$decode\n";
}

测试输出:
%40%23
%40%23 ->[URLdecode]@# ->[GBKDecode]@#
%40%23 -> [URLdecode]@#

2:UTF-8进行URL编码。

因为汉字采用的是GBK编码,因此不论在URL编码前还是在URL解码后,都需要调用相应函数进行操作。
对于UTF-8的编码和解码,我们使用UTF-8模块中的函数。
如下是编码后又解码的过程:

while(<>){
        chomp;

        my $utf8str = $_;
        utf8::encode($utf8str); #进行UTF-8编码,函数直接操作变量
        my $encode = URI::Escape::uri_escape($utf8str); #对已经经过UTF-8编码的对象进行URL编码
        print "UTF-8 Encode:[$_] -> [$utf8str] -> [$encode]\n";

        my $urldecode = URI::Escape::uri_unescape($encode); #对经过UTF-8编码的URL进行URL解码
        my $decode = $urldecode; 
        utf8::decode($decode); #对经过URL解码后的字符串进行UTF-8解码
        print "UTF-8 Decode:[$encode] -> [$urldecode] -> [$decode]\n";
}

测试输出:
测试
UTF-8 Encode:[测试] -> [²âÊÔ] -> [%C2%B2%C3%A2%C3%8A%C3%94]
UTF-8 Decode:[%C2%B2%C3%A2%C3%8A%C3%94] -> [²âÊÔ] -> [测试]
 

 

总结:大多数国内网站对中文编码都采用GBK,因为这样会少一步编码处理。比如百度,即采用GBK编码。

但是国外网站大多采用UTF-8编码,因为UTF-8相对GBK更广泛。


鲜花

握手

雷人

路过

鸡蛋
该文章已有0人参与评论

请发表评论

全部评论

专题导读
上一篇:
功能丰富的Perl:轻松调试Perl的技巧发布时间:2022-07-22
下一篇:
在Perl中使用Getopt::Long模块来接收用户命令行参数发布时间:2022-07-22
热门推荐
热门话题
阅读排行榜

扫描微信二维码

查看手机版网站

随时了解更新最新资讯

139-2527-9053

在线客服(服务时间 9:00~18:00)

在线QQ客服
地址:深圳市南山区西丽大学城创智工业园
电邮:jeky_zhao#qq.com
移动电话:139-2527-9053

Powered by 互联科技 X3.4© 2001-2213 极客世界.|Sitemap