php数组对百万数据进行排除重复数据的实现代码


Posted in PHP onJune 08, 2010

假如得到一个uid列表,数量在百万行以上,格式如下:

10001000 
10001001 
10001002 
...... 
10001000 
...... 
10001111

其实利用php数组的特性,很好进行排重,我们先来看一下php数组的定义:PHP 中的数组实际上是一个有序映射。映射是一种把 values 关联到 keys 的类型。此类型在很多方面做了优化,因此可以把它当成真正的数组,或列表(向量),散列表(是映射的一种实现),字典,集合,栈,队列以及更多可能性。数组元素的值也可以是另一个数组。树形结构和多维数组也是允许的。

在php的数组中,键(keys)也称为索引,具有唯一性,我们正可以利用这一特性进行排重,示例代码如下:

<?php 
//定义一个数组,用于存放排重后的结果 
$result = array(); 
//读取uid列表文件 
$fp = fopen('test.txt', 'r'); while(!feof($fp)) 
{ 
$uid = fgets($fp); 
$uid = trim($uid); 
$uid = trim($uid, "\r"); 
$uid = trim($uid, "\n"); 
if($uid == '') 
{ 
continue; 
} 
//以uid为key去看该值是否存在 
if(empty($result[$uid])) 
{ 
$result[$uid] = 1; 
} 
} 
fclose($fp); 
//将结果保存到文件 
$content = ''; 
foreach($result as $k => $v) 
{ 
$content .= $k."\n"; 
} 
$fp = fopen('result.txt', 'w'); 
fwrite($fp, $content); 
fclose($fp); 
?>

20多行代码,就可以对百万以上的数据进行排重,效率也不错,非常实用。手机号、email,也可以采用这种方式进行排重。

还有,这可方法还可以用于两个文件进行排重的工作,如果你有两个uid列表文件,格式和上面的uid列表一样,示例程序如下:

<?php 
//定义数组,用于存放排重后的结果 
$result = array(); 
//读取第一个uid列表文件,放入$result_1 
$fp = fopen('test_1.txt', 'r'); 
while(!feof($fp)) 
{ 
$uid = fgets($fp); 
$uid = trim($uid); 
$uid = trim($uid, "\r"); 
$uid = trim($uid, "\n"); 
if($uid == '') 
{ 
continue; 
} 
//以uid为key写入$result,如有重复就会覆盖 
$result[$uid] = 1; 
} 
fclose($fp); 
//读取第二个uid列表文件,并进行排重操作 
$fp = fopen('test_2.txt', 'r'); 
while(!feof($fp)) 
{ 
$uid = fgets($fp); 
$uid = trim($uid); 
$uid = trim($uid, "\r"); 
$uid = trim($uid, "\n"); 
if($uid == '') 
{ 
continue; 
} 
//以uid为key去看该值是否存在 
if(empty($result[$uid])) 
{ 
$result[$uid] = 1; 
} 
} 
fclose($fp); 
//$result里保存的就排重以后的结果,可以输出到文件,代码省略 
?>

仔细想想,不难发现,利用数组的这一特性还可以解决我们工作中的更多问题。
PHP 相关文章推荐
如何提高MYSQL数据库的查询统计速度 select 索引应用
Apr 11 PHP
国外比较好的几个的Php开源建站平台小结
Apr 22 PHP
腾讯QQ php程序员面试题目整理
Jun 08 PHP
UCenter中的一个可逆加密函数authcode函数代码
Jul 20 PHP
php重定向的三种方法分享
Feb 22 PHP
PHP使用mysql_fetch_row查询获得数据行列表的方法
Mar 18 PHP
百度地图经纬度转换到腾讯地图/Google 对应的经纬度
Aug 28 PHP
PHP中创建和编辑Excel表格的方法
Sep 13 PHP
YII框架常用技巧总结
Apr 27 PHP
PHP7数组的底层实现示例
Aug 25 PHP
关于laravel后台模板laravel-admin select框的使用详解
Oct 03 PHP
PHP如何开启Opcache功能提升程序处理效率
Apr 27 PHP
腾讯QQ php程序员面试题目整理
Jun 08 #PHP
php 上传文件类型判断函数(避免上传漏洞 )
Jun 08 #PHP
php的字符串用法小结
Jun 08 #PHP
php文章内容分页并生成相应的htm静态页面代码
Jun 07 #PHP
php获取当前网址url并替换参数或网址的方法
Jun 06 #PHP
phpmyadmin里面导入sql语句格式的大量数据的方法
Jun 05 #PHP
php 智能404跳转代码,适合换域名没改变目录的网站
Jun 04 #PHP
You might like
php+mysql分页代码详解
2008/03/27 PHP
获取远程文件大小的php函数
2010/01/11 PHP
PHP网页游戏学习之Xnova(ogame)源码解读(一)
2014/06/23 PHP
ThinkPHP验证码和分页实例教程
2014/08/22 PHP
Yii2 RESTful中api的使用及开发实例详解
2016/07/06 PHP
利用javascript查看html源文件
2006/11/08 Javascript
Javascript学习笔记 delete运算符
2011/09/13 Javascript
深入了解javascript中的prototype与继承
2013/04/14 Javascript
使用js实现按钮控制文本框加1减1应用于小时+分钟
2013/12/09 Javascript
原生js和jquery中有关透明度设置的相关问题
2014/01/08 Javascript
页面装载js及性能分析方法介绍
2014/03/21 Javascript
JS基于面向对象实现的放烟花效果
2015/05/07 Javascript
JS实现密码框根据焦点的获取与失去控制文字的消失与显示效果
2015/11/26 Javascript
Kindeditor在线文本编辑器如何过滤HTML
2016/04/14 Javascript
JS实现页面跳转与刷新的方法汇总
2019/08/30 Javascript
vue使用高德地图点击下钻上浮效果的实现思路
2019/10/12 Javascript
[04:38]完美世界携手游戏风云打造 卡尔工作室饰品系统篇
2013/04/25 DOTA
Python入门篇之列表和元组
2014/10/17 Python
python2.7实现爬虫网页数据
2018/05/25 Python
详解将Django部署到Centos7全攻略
2018/09/26 Python
pandas 数据结构之Series的使用方法
2019/06/21 Python
Pandas分组与排序的实现
2019/07/23 Python
CSS3 透明色 RGBA使用介绍
2013/08/06 HTML / CSS
利用SVG和CSS3来实现一个炫酷的边框动画
2015/07/22 HTML / CSS
索尼巴西商店:Sony巴西
2019/06/21 全球购物
应用化学专业职业生涯规划书
2013/12/31 职场文书
投标承诺书范本
2014/03/27 职场文书
捐书活动总结
2014/05/04 职场文书
社区安全生产月活动总结
2014/07/05 职场文书
聚会通知怎么写
2015/04/23 职场文书
外出培训学习心得体会
2016/01/18 职场文书
2019大学生暑期实习心得总结
2019/08/21 职场文书
导游词之南京汤山温泉
2019/11/26 职场文书
golang日志包logger的用法详解
2021/05/05 Golang
Mysql中调试存储过程最简单的方法
2021/06/30 MySQL
数据分析数据库ClickHouse在大数据领域应用实践
2022/04/03 MySQL