PHP也能干大事之PHP中的编码解码详解


Posted in PHP onApril 20, 2015

写在前面

PHP也能干大事是我总结的PHP语法特性及相关函数类库的经典用法,并不一定是真正能实现四两拨千斤的功效,但是掌握这些方法,可以在你的工作和学习上有一些帮助,希望大家能集思广益,将《PHP也能干大事》丰富得更精彩!转载请注明出处(3water.com)

二、前言

PHP是常见的脚本语言,主要是因为其简单易学,上手快,几乎50%以上的Web程序都有PHP的身影(不完全统计)。PHP为开发这提供了丰富的函数和API接口,这使得我们能够非常方便地使用其强大的内置函数及扩展,本文是《PHP也能干大事》系列的第一篇,主要总结PHP在编解码、进制转换方面的知识。

PHP也能干大事之PHP中的编码解码详解

三、PHP编解码

1、ASCII编解码

ASCII(发音:英语发音:/ˈæski/ ASS-kee,American Standard Code for Information Interchange,美国信息交换标准代码)是基于拉丁字母的一套电脑编码系统。它主要用于显示现代英语,而其扩展版本EASCII则可以部分支持其他西欧语言,并等同于国际标准ISO/IEC 646。由于万维网使得ASCII广为通用,直到2007年12月,逐渐被Unicode取代。 https://zh.wikipedia.org/zh/ASCII

PHP也能干大事之PHP中的编码解码详解

PHP基本函数内置了ASCII的编解码函数,这使得我们能轻松进行ASCII编解码。

int ord ( string $string ) //返回字符串 string 第一个字符的 ASCII 码值。
string chr ( int $ascii  ) //返回相对应于 ascii 所指定的单个字符。

<?php

$str = 'Welcome to China';

function getNum($string){

    $needle = 0;

    $num = '';

    while (isset($string[$needle])) {

        $num .= $num==0?'':' ';

        $num .= ord($string[$needle]);

        $needle++;

    }

    return $num;

}

function getChar($num){

    $num_arr = explode(' ', $num);

    $string = '';

    foreach ($num_arr as $value) {

        $string .= chr($value);

    }

    return $string;

}

echo "字符转ASCII码\n";

echo getNum($str);

echo "\n";

echo "ASCII码字符\n";

echo getChar(getNum($str));

/* @OUTPUT

字符转ASCII码

87 101 108 99 111 109 101 32 116 111 32 67 104 105 110 97

ASCII码字符

Welcome to China

*/

 

?>

2、URL编解码

URL编码是一种浏览器用来打包表单输入的格式。浏览器从表单中获取所有的name和其中的值,将它们以name/value参数编码作为URL的一部分或者分离地发给服务器。比如我们在访问网页中,会出现很多带有%的字符串,这就是URL编码。

URL编码一般采用UTF-8编码格式,所以建议采用UTF-8格式传递数据。正常意义的URL编码可以理解为ASCII码的16进制前加上%,无大小写区分。

string urlencode(string $str)  //此函数便于将字符串编码并将其用于URL的请求部分,同时它还便于将变量传递给下一页。空格编码成 + 。

string urldecode(string $str)  //解码给出的已编码字符串中的任何 %XX,加号('+')被解码成一个空格字符。

string rawurlencode (string $str)   //根据 RFC 3986 编码指定的字符,空格转换成%20。

string rawurldecode (string $str)   //返回字符串,此字符串中百分号(%)后跟两位十六进制数的序列都将被替换成原义字符。 + 不被转换成空格。

两组函数用法一样,除了对于+和空格的转换处理上:rawurlencode将空格转为%20,不将+转为空格;urlencode则不一样。

<?php

$str_arr = array(

    '3water.com',

    'https://3water.com/',

    'PHP也能干大事',

    '!@#$%^&*()_+=-~`[]{}|\\;:\'"<>,./?'

    );

foreach ($str_arr as $key => $value) {

    echo $value,"\t->\t",urlencode($value),"\n";

}

/* @OUTPUT
3water.com  ->    3water.com
https://3water.com/  ->    http%3A%2F%2F3water.com%2F

PHP也能干大事  ->    PHP%E4%B9%9F%E8%83%BD%E5%B9%B2%E5%A4%A7%E4%BA%8B
!@#$%^&*()_+=-~`[]{}|\;:'"<>,./?      ->    %21%40%23%24%25%5E%26%2A%28%29_%2B%3D-%7E%60%5B%5D%7B%7D%7C%5C%3B%3A%27%22%3C%3E%2C.%2F%3F

*/

?>

3、Base64编解码

Base64是一种基于64个可打印字符来表示二进制数据的表示方法。由于2的6次方等于64,所以每6个位元为一个单元,对应某个可打印字符。三个字节有24个位元,对应于4个Base64单元,即3个字节需要用4个可打印字符来表示。它可用来作为电子邮件的传输编码。使用的字符包括大小写字母各26个,加上10个数字,和加号「+」,斜杠「/」,一共64个字符,等号「=」用来作为后缀用途。完整的base64定义可见RFC 1421和RFC 2045。编码后的数据比原始数据略长,为原来的4/3。在电子邮件中,根据RFC 822规定,每76个字符,还需要加上一个回车换行。可以估算编码后数据长度大约为原长的135.1%。 https://zh.wikipedia.org/zh/Base64

string base64_encode(string $data)  //使用 base64 对 data 进行编码。
string base64_decode (string $data [, bool $strict = false ])  //对 base64 编码的 data 进行解码。

案例:HTML页面中img标签可以在src属性中采用base64编码方式,来输出图片,这样可以减少HTTP请求次数。

<?php

$string = file_get_content('3mc2.png');

echo '<img src="data:image/png;base64,',base64_encode($string),'">';

/* @OUTPUT

UEhQ5Lmf6IO95Yqe5aSn5LqL

*/

?>

4、HTML实体编解码

一些字符在HTML中是预留的,拥有特殊的含义,比如小于号「<」用于定义HTML标签的开始。如果我们希望浏览器正确地显示这些字符,我们必须在 HTML 源码中插入字符实体。字符实体有三部分:一个和号「&」 和一个实体名称(或者一个 「#」 和一个实体编号),以及一个分号「;」。http://www.ascii.cl/htmlcodes.htm

string htmlspecialchars ( string $string [, int $flags = ENT_COMPAT | ENT_HTML401 [, string $encoding = “UTF-8″ [, bool $double_encode = true ]]] )  //对包含如下HTML特殊字符进行HTML实体编码
1.'&' (ampersand) becomes ‘&'
2.'”‘ (double quote) becomes ‘"' when ENT_NOQUOTES is not set.
3.”‘” (single quote) becomes ‘'' (or ') only when ENT_QUOTES is set.
4.'<‘ (less than) becomes ‘<'
5.'>' (greater than) becomes ‘>'

string htmlspecialchars_decode (string $string [, int $flags = ENT_COMPAT | ENT_HTML401 ])  //此函数的作用和 htmlspecialchars() 刚好相反。它将特殊的HTML实体转换回普通字符。
还有功能相同的函数htmlentities/html_entity_decode,这对函数甚至对汉字都进行了HTML实体编码,而且会产生乱码,所以建议使用htmlspecialchars进行编解码。

案例:防止XSS跨站脚本攻击,需要对用户提交的数据进行HTML实体转换:

<?php

$_POST['message'] = '测试留言字符\'"><sCript src=https://3water.com/hook.js>';

if (empty($_POST['message'])) {

    exit('Message is NULL');

}

$message = htmlspecialchars(trim($_POST['message']));

echo $message;

/* @OUTPUT

测试留言字符'"><sCript src=https://3water.com/hook.js>

*/

?>

5、二进制、八进制、十进制、十六进制相互转换

进制之间的转换这里没什么好说的,总之都差不多,只要记住多少进制就是逢多少进一位,比如10进制就是9的下一位就是10,二进制、八进制、十六进制以此类推。

string bin2hex (string $str) //返回 ASCII 字符串,为参数 str 的十六进制表示。转换使用字节方式,高四位字节优先。
string hex2bin (string $data) //转换十六进制字符串为二进制字符串。
number bindec (string $binary_string) //返回 binary_string 参数所表示的二进制数的十进制等价值。
string decbin (int $number) //返回一字符串,包含有给定 number 参数的二进制表示。所能转换的最大数值为十进制的 4294967295,其结果为 32 个 1 的字符串。
number octdec (string $octal_string) //返回 octal_string 参数所表示的八进制数的十进制等值。
string decoct (int $number) //返回一字符串,包含有给定 number 参数的八进制表示。所能转换的最大数值为十进制的 4294967295,其结果为 “37777777777”。
string base_convert (string $number , int $frombase , int $tobase) //任意进制转换,返回一字符串,包含 number 以 tobase 进制的表示。number 本身的进制由 frombase 指定。frombase 和 tobase 都只能在 2 和 36 之间(包括 2 和 36)。高于十进制的数字用字母 a-z 表示,例如 a 表示 10,b 表示 11 以及 z 表示 35。

6 、GBK、UTF-8字符编码转换

在写代码过程中,经常遇到编码问题而引发的乱码。其实解决编码问题非常简单,只要使用一种编码即可,一般来说,采用万国码——UTF-8是最好的选择。

这里说的编码是文字编码和文件存储的编码,当然,不得不提到系统的编码的差异性:

系统             编码     字符结尾
Windows    GBK     \r\n
*nix             UTF-8   \n

所以在处理特殊字符的时候要特别注意。

常见的编码有GBK、UTF-8等等,函数使用上一般采用两种:

string mb_convert_encoding (string $str , string $to_encoding [, mixed $from_encoding = mb_internal_encoding() ])  //将 string 类型 str 的字符编码从可选的 from_encoding 转换到 to_encoding。
string iconv (string $in_charset , string $out_charset , string $str)  //将字符串 str 从 in_charset 转换编码到 out_charset。

案例:Windows系统,架设了一个WAMP服务器,将如下脚本另存为一个UTF-8编码的php文件,即可通过浏览器查看无乱码的php目录里的文件;如果不是用mb_convert_encoding转码,将直接导致输出乱码(Windows作为服务器)。

<?php 

    function getDir($dir){

        static $string = '';

        if(is_file($dir)){

            $string.= $dir;

        }else{

            $oDir = @opendir($dir);

            while($fileName = readdir($oDir)){

                if($fileName!='.' && $fileName!='..'){

                    if(is_file($dir.'/'.$fileName)){

                        $string.=$fileName."\n";

                    }elseif(is_dir($dir.'/'.$fileName)){

                        $string.= $dir.'/'.$fileName.'/'."\n";

                        getDir($dir.'/'.$fileName);

                    }

                }

            }

        }

        return $string;

    }

    echo mb_convert_encoding( getDir('php'),'utf8', 'gbk' );

 

?>

四、总结

编码是数据的处理的基础,所以在PHP的编程开发过程中是相当重要的。对于PHP的处理方法,应用在编程中还需要数量掌握,特别有些相似函数要如何区分。转载请注明出处(3water.com)

PHP 相关文章推荐
用Flash图形化数据(二)
Oct 09 PHP
php中定时计划任务的实现原理
Jan 08 PHP
PHP处理excel cvs表格的方法实例介绍
May 13 PHP
php上传文件中文文件名乱码的解决方法
Nov 01 PHP
最常用的8款PHP调试工具
Jul 06 PHP
Drupal简体中文语言包安装教程
Sep 27 PHP
ThinkPHP中Session用法详解
Nov 29 PHP
php恢复数组的key为数字序列的方法
Apr 28 PHP
laravel migrate初学常见错误的解决方法
Oct 11 PHP
yii2安装详细流程
May 23 PHP
PHP _construct()函数讲解
Feb 03 PHP
Thinkphp 框架扩展之驱动扩展实例分析
Apr 27 PHP
php中使用base HTTP验证的方法
Apr 20 #PHP
PHP加密解密类实例分析
Apr 20 #PHP
php通过分类列表产生分类树数组的方法
Apr 20 #PHP
PHP统计数值数组中出现频率最多的10个数字的方法
Apr 20 #PHP
PHP查找数值数组中不重复最大和最小的10个数的方法
Apr 20 #PHP
php获取本周星期一具体日期的方法
Apr 20 #PHP
php实现猴子选大王问题算法实例
Apr 20 #PHP
You might like
用php和MySql来与ODBC数据连接
2006/10/09 PHP
利用PHP和AJAX创建RSS聚合器的代码
2007/03/13 PHP
PHP 调试工具Debug Tools
2011/04/30 PHP
PHP中怎样防止SQL注入分析
2014/10/23 PHP
iOS+PHP注册登录系统 PHP部分(上)
2016/12/26 PHP
总结PHP代码规范、流程规范、git规范
2018/06/18 PHP
jquery.cookie.js的介绍与使用方法
2017/02/09 Javascript
jQuery插件FusionCharts绘制的3D饼状图效果实例【附demo源码下载】
2017/03/03 Javascript
Node.js v8.0.0正式发布!看看带来了哪些主要新特性
2017/06/02 Javascript
详解在React里使用&quot;Vuex&quot;
2018/04/02 Javascript
JS实现数组去重,显示重复元素及个数的方法示例
2019/01/21 Javascript
每天学点Vue源码之vm.$mount挂载函数
2019/03/11 Javascript
vue-cli的build的文件夹下没有dev-server.js文件配置mock数据的方法
2019/04/17 Javascript
浅谈关于vue中scss公用的解决方案
2019/12/02 Javascript
JavaScript设计模型Iterator实例解析
2020/01/22 Javascript
[00:58]PWL开团时刻DAY5——十人开雾0换5
2020/11/04 DOTA
Python正则表达式知识汇总
2017/09/22 Python
Python_LDA实现方法详解
2017/10/25 Python
python下10个简单实例代码
2017/11/15 Python
python中实现数组和列表读取一列的方法
2018/04/03 Python
使用python PIL库实现简单验证码的去噪方法步骤
2019/05/10 Python
python GUI库图形界面开发之PyQt5线程类QThread详细使用方法
2020/02/26 Python
Python Django form 组件动态从数据库取choices数据实例
2020/05/19 Python
django queryset 去重 .distinct()说明
2020/05/19 Python
解决django migrate报错ORA-02000: missing ALWAYS keyword
2020/07/02 Python
python中watchdog文件监控与检测上传功能
2020/10/30 Python
原生canvas制作画图小工具的踩坑和爬坑
2020/06/09 HTML / CSS
英国Office鞋店德国网站:在线购买鞋子、靴子和运动鞋
2018/12/19 全球购物
正规的求职信范文分享
2013/12/11 职场文书
和平主题的演讲稿
2014/01/12 职场文书
高二地理教学反思
2014/01/24 职场文书
运动会入场式解说词
2014/02/18 职场文书
财务管理职业生涯规划书
2014/02/26 职场文书
工程质量承诺书
2014/03/27 职场文书
政府个人对照检查材料思想汇报
2014/10/08 职场文书
flex弹性布局详解
2022/03/20 HTML / CSS