php数组对百万数据进行排除重复数据的实现代码


Posted in PHP onJune 08, 2010

假如得到一个uid列表,数量在百万行以上,格式如下:

10001000 
10001001 
10001002 
...... 
10001000 
...... 
10001111

其实利用php数组的特性,很好进行排重,我们先来看一下php数组的定义:PHP 中的数组实际上是一个有序映射。映射是一种把 values 关联到 keys 的类型。此类型在很多方面做了优化,因此可以把它当成真正的数组,或列表(向量),散列表(是映射的一种实现),字典,集合,栈,队列以及更多可能性。数组元素的值也可以是另一个数组。树形结构和多维数组也是允许的。

在php的数组中,键(keys)也称为索引,具有唯一性,我们正可以利用这一特性进行排重,示例代码如下:

<?php 
//定义一个数组,用于存放排重后的结果 
$result = array(); 
//读取uid列表文件 
$fp = fopen('test.txt', 'r'); while(!feof($fp)) 
{ 
$uid = fgets($fp); 
$uid = trim($uid); 
$uid = trim($uid, "\r"); 
$uid = trim($uid, "\n"); 
if($uid == '') 
{ 
continue; 
} 
//以uid为key去看该值是否存在 
if(empty($result[$uid])) 
{ 
$result[$uid] = 1; 
} 
} 
fclose($fp); 
//将结果保存到文件 
$content = ''; 
foreach($result as $k => $v) 
{ 
$content .= $k."\n"; 
} 
$fp = fopen('result.txt', 'w'); 
fwrite($fp, $content); 
fclose($fp); 
?>

20多行代码,就可以对百万以上的数据进行排重,效率也不错,非常实用。手机号、email,也可以采用这种方式进行排重。

还有,这可方法还可以用于两个文件进行排重的工作,如果你有两个uid列表文件,格式和上面的uid列表一样,示例程序如下:

<?php 
//定义数组,用于存放排重后的结果 
$result = array(); 
//读取第一个uid列表文件,放入$result_1 
$fp = fopen('test_1.txt', 'r'); 
while(!feof($fp)) 
{ 
$uid = fgets($fp); 
$uid = trim($uid); 
$uid = trim($uid, "\r"); 
$uid = trim($uid, "\n"); 
if($uid == '') 
{ 
continue; 
} 
//以uid为key写入$result,如有重复就会覆盖 
$result[$uid] = 1; 
} 
fclose($fp); 
//读取第二个uid列表文件,并进行排重操作 
$fp = fopen('test_2.txt', 'r'); 
while(!feof($fp)) 
{ 
$uid = fgets($fp); 
$uid = trim($uid); 
$uid = trim($uid, "\r"); 
$uid = trim($uid, "\n"); 
if($uid == '') 
{ 
continue; 
} 
//以uid为key去看该值是否存在 
if(empty($result[$uid])) 
{ 
$result[$uid] = 1; 
} 
} 
fclose($fp); 
//$result里保存的就排重以后的结果,可以输出到文件,代码省略 
?>

仔细想想,不难发现,利用数组的这一特性还可以解决我们工作中的更多问题。
PHP 相关文章推荐
PHP中的日期及时间
Nov 23 PHP
php 缓存函数代码
Aug 27 PHP
一道关于php变量引用的面试题
Aug 08 PHP
PHP二维数组的去重问题解析
Jul 17 PHP
php URL验证正则表达式
Jul 19 PHP
web站点获取用户IP的安全方法 HTTP_X_FORWARDED_FOR检验
Jun 01 PHP
php解析json数据实例
Aug 19 PHP
php实现按指定大小等比缩放生成上传图片缩略图的方法
Dec 15 PHP
PHP随机数 C扩展随机数
May 04 PHP
非常实用的php验证码类
May 15 PHP
yii2实现 &quot;上一篇,下一篇&quot; 功能的代码实例
Feb 04 PHP
利用PHP扩展Xhprof分析项目性能实践教程
Sep 05 PHP
腾讯QQ php程序员面试题目整理
Jun 08 #PHP
php 上传文件类型判断函数(避免上传漏洞 )
Jun 08 #PHP
php的字符串用法小结
Jun 08 #PHP
php文章内容分页并生成相应的htm静态页面代码
Jun 07 #PHP
php获取当前网址url并替换参数或网址的方法
Jun 06 #PHP
phpmyadmin里面导入sql语句格式的大量数据的方法
Jun 05 #PHP
php 智能404跳转代码,适合换域名没改变目录的网站
Jun 04 #PHP
You might like
php广告加载类用法实例
2014/09/23 PHP
php实现的css文件背景图片下载器代码
2014/11/11 PHP
CentOS下PHP安装Oracle扩展
2015/02/15 PHP
PHP代码维护,重构变困难的4种原因分析
2016/01/25 PHP
PHP 7.0新增加的特性介绍
2017/06/08 PHP
php 利用socket发送GET,POST请求的实例代码
2020/07/04 PHP
jQuery Ajax之$.get()方法和$.post()方法
2009/10/12 Javascript
基于JQuery的cookie插件
2010/04/07 Javascript
js获取dom的高度和宽度(可见区域及部分等等)
2013/06/13 Javascript
js获取IP和PcName(IE)在vs中可用
2013/08/02 Javascript
Jquery自定义button按钮的几种方法
2014/06/11 Javascript
JavaScript函数详解
2014/11/17 Javascript
JavaScript中Number.MIN_VALUE属性的使用示例
2015/06/04 Javascript
JavaScript原生xmlHttp与jquery的ajax方法json数据格式实例
2015/12/04 Javascript
基于javascript实现全屏漂浮广告
2016/03/31 Javascript
jQuery居中元素scrollleft计算方法示例
2017/01/16 Javascript
div中文字内容溢出常见的解决方法
2017/03/16 Javascript
JS字符串统计操作示例【遍历,截取,输出,计算】
2017/03/27 Javascript
关于bootstrap日期转化,bootstrap-editable的简单使用,bootstrap-fileinput的使用详解
2017/05/12 Javascript
vue组件tabbar使用方法详解
2018/11/06 Javascript
JS实现点击li标签弹出对应的索引功能【案例】
2019/02/18 Javascript
JavaScript数据结构与算法之检索算法实例分析【顺序查找、最大最小值、自组织查询】
2019/02/22 Javascript
微信小程序登录对接Django后端实现JWT方式验证登录详解
2019/07/29 Javascript
微信小程序批量监听输入框对按钮样式进行控制的实现代码
2019/10/12 Javascript
python在windows下创建隐藏窗口子进程的方法
2015/06/04 Python
浅谈Python的文件类型
2016/05/30 Python
使用Python3制作TCP端口扫描器
2017/04/17 Python
python交互式图形编程实例(二)
2017/11/17 Python
Python基于高斯消元法计算线性方程组示例
2018/01/17 Python
python实现月食效果实例代码
2019/06/18 Python
Python安装及Pycharm安装使用教程图解
2019/09/20 Python
python 一维二维插值实例
2020/04/22 Python
HTML5 localStorage使用总结
2017/02/22 HTML / CSS
计算机应用专业应届毕业生中文求职信范文
2013/11/29 职场文书
2014年幼儿园保育工作总结
2014/12/02 职场文书
Python多线程 Queue 模块常见用法
2021/07/04 Python