php数组对百万数据进行排除重复数据的实现代码


Posted in PHP onJune 08, 2010

假如得到一个uid列表,数量在百万行以上,格式如下:

10001000 
10001001 
10001002 
...... 
10001000 
...... 
10001111

其实利用php数组的特性,很好进行排重,我们先来看一下php数组的定义:PHP 中的数组实际上是一个有序映射。映射是一种把 values 关联到 keys 的类型。此类型在很多方面做了优化,因此可以把它当成真正的数组,或列表(向量),散列表(是映射的一种实现),字典,集合,栈,队列以及更多可能性。数组元素的值也可以是另一个数组。树形结构和多维数组也是允许的。

在php的数组中,键(keys)也称为索引,具有唯一性,我们正可以利用这一特性进行排重,示例代码如下:

<?php 
//定义一个数组,用于存放排重后的结果 
$result = array(); 
//读取uid列表文件 
$fp = fopen('test.txt', 'r'); while(!feof($fp)) 
{ 
$uid = fgets($fp); 
$uid = trim($uid); 
$uid = trim($uid, "\r"); 
$uid = trim($uid, "\n"); 
if($uid == '') 
{ 
continue; 
} 
//以uid为key去看该值是否存在 
if(empty($result[$uid])) 
{ 
$result[$uid] = 1; 
} 
} 
fclose($fp); 
//将结果保存到文件 
$content = ''; 
foreach($result as $k => $v) 
{ 
$content .= $k."\n"; 
} 
$fp = fopen('result.txt', 'w'); 
fwrite($fp, $content); 
fclose($fp); 
?>

20多行代码,就可以对百万以上的数据进行排重,效率也不错,非常实用。手机号、email,也可以采用这种方式进行排重。

还有,这可方法还可以用于两个文件进行排重的工作,如果你有两个uid列表文件,格式和上面的uid列表一样,示例程序如下:

<?php 
//定义数组,用于存放排重后的结果 
$result = array(); 
//读取第一个uid列表文件,放入$result_1 
$fp = fopen('test_1.txt', 'r'); 
while(!feof($fp)) 
{ 
$uid = fgets($fp); 
$uid = trim($uid); 
$uid = trim($uid, "\r"); 
$uid = trim($uid, "\n"); 
if($uid == '') 
{ 
continue; 
} 
//以uid为key写入$result,如有重复就会覆盖 
$result[$uid] = 1; 
} 
fclose($fp); 
//读取第二个uid列表文件,并进行排重操作 
$fp = fopen('test_2.txt', 'r'); 
while(!feof($fp)) 
{ 
$uid = fgets($fp); 
$uid = trim($uid); 
$uid = trim($uid, "\r"); 
$uid = trim($uid, "\n"); 
if($uid == '') 
{ 
continue; 
} 
//以uid为key去看该值是否存在 
if(empty($result[$uid])) 
{ 
$result[$uid] = 1; 
} 
} 
fclose($fp); 
//$result里保存的就排重以后的结果,可以输出到文件,代码省略 
?>

仔细想想,不难发现,利用数组的这一特性还可以解决我们工作中的更多问题。
PHP 相关文章推荐
dedecms模版制作使用方法
Apr 03 PHP
php5 图片验证码实现代码
Dec 11 PHP
PHP $_FILES中error返回值详解
Jan 30 PHP
PHP图片等比缩放类SimpleImage使用方法和使用实例分享
Apr 10 PHP
php截取html字符串及自动补全html标签的方法
Jan 15 PHP
完美解决phpdoc导出文档中@package的warning及Error的错误
May 17 PHP
PHP中session跨子域的三种实现方法
Jul 25 PHP
PHP请求Socket接口测试实例
Aug 12 PHP
php封装的单文件(图片)上传类完整实例
Oct 18 PHP
thinkPHP+ajax实现统计页面pv浏览量的方法
Mar 15 PHP
老生常谈PHP面向对象之注册表模式
May 26 PHP
PHP基于ip2long实现IP转换整形
Dec 11 PHP
腾讯QQ php程序员面试题目整理
Jun 08 #PHP
php 上传文件类型判断函数(避免上传漏洞 )
Jun 08 #PHP
php的字符串用法小结
Jun 08 #PHP
php文章内容分页并生成相应的htm静态页面代码
Jun 07 #PHP
php获取当前网址url并替换参数或网址的方法
Jun 06 #PHP
phpmyadmin里面导入sql语句格式的大量数据的方法
Jun 05 #PHP
php 智能404跳转代码,适合换域名没改变目录的网站
Jun 04 #PHP
You might like
php 不同编码下的字符串长度区分
2009/09/26 PHP
深入PHP中的HashTable结构详解
2013/06/13 PHP
PHP执行Curl时报错提示CURL ERROR: Recv failure: Connection reset by peer的解决方法
2014/06/26 PHP
php技术实现加载字体并保存成图片
2015/07/27 PHP
今天你说520了吗?不仅有php表白书还有java表白神器
2016/05/20 PHP
实例分析10个PHP常见安全问题
2019/07/09 PHP
Jquery 获取表单text,areatext,radio,checkbox,select值的代码
2009/11/12 Javascript
IE本地存储userdata的一个bug说明
2010/07/01 Javascript
拉动滚动条加载数据的jquery代码
2012/05/03 Javascript
在JS方法中返回多个值的方法汇总
2015/05/20 Javascript
JavaScript的removeChild()函数用法详解
2015/12/27 Javascript
ES6新特征数字、数组、字符串
2016/10/01 Javascript
jquery移除了live()、die(),新版事件绑定on()、off()的方法
2016/10/26 Javascript
JavaScript获取当前时间向前推三个月的方法示例
2017/02/04 Javascript
Require.JS中的几种define定义方式示例
2017/06/01 Javascript
JavaScript实现左侧菜单效果
2017/12/14 Javascript
[03:24]DOTA2超级联赛专访hao 大翻盘就是逆袭
2013/05/24 DOTA
使用python的chardet库获得文件编码并修改编码
2014/01/22 Python
Django基础知识与基本应用入门教程
2018/07/20 Python
获取Pytorch中间某一层权重或者特征的例子
2019/08/17 Python
opencv3/C++实现视频背景去除建模(BSM)
2019/12/11 Python
Python实现i人事自动打卡的示例代码
2020/01/09 Python
Python3中的f-Strings增强版字符串格式化方法
2020/03/04 Python
高级销售员求职信
2013/10/25 职场文书
学生实习推荐信范文
2013/11/26 职场文书
入党思想汇报
2014/01/05 职场文书
市场调查策划方案
2014/06/10 职场文书
装修活动策划方案
2014/08/27 职场文书
2014院党委领导班子及其成员群众路线对照检查材料思想汇报
2014/10/04 职场文书
学生上课说话检讨书
2014/10/25 职场文书
给老婆的检讨书1000字
2015/01/01 职场文书
飞屋环游记观后感
2015/06/08 职场文书
放飞理想主题班会
2015/08/14 职场文书
自荐信范文
2019/05/20 职场文书
少儿励志名言(80句)
2019/08/14 职场文书
Mysql InnoDB 的内存逻辑架构
2022/05/06 MySQL