如何应用php数组对百万数据停止排重
如何应用php数组对百万数据停止排重
在往常的工作中,常常接到要对网站的会员停止站内信、手机短信、email停止群发信息的告诉,用户列表普通由别的同事提供,当中难免会有反复,为了避免反复发送,所以我在停止发送信息前要对他们提供的用户列表停止排重,下面我以uid列表来讲讲我是如何应用php数组停止排重的。
如果失去一个uid列表,数量在百万行以上,格式如下:
10001000
10001001
10001002
................
10001000
................
10001111
其实应用php数组的特性,很好停止排重,咱们先来看一下php数组的定义:PHP 中的数组实践上是一个有序映射。映射是一种把 values 关联到 keys 的类型。此类型在很多方面做了优化,因此可能把它当成真正的数组,或列表(向量),散列表(是映射的一种完成),字典,汇合,栈,队列以及更多能够性。数组元素的值也可能是另一个数组。树形构造和多维数组也是容许的。
在php的数组中,键(keys)也称为索引,具备惟一性,咱们正可能应用这一特性停止排重,示例代码如下:
//定义一个数组,用于寄存排重后的后果
$result = array();
//读取uid列表文件
$fp = fopen('test.txt', 'r');
while(!feof($fp))
{
$uid = fgets($fp);
$uid = trim($uid);
$uid = trim($uid, "r");
$uid = trim($uid, "n");
if($uid == '')
{
continue;
}
//以uid为key去看该值能否存在
if(empty($result[$uid]))
{
$result[$uid] = 1;
}
}
fclose($fp);
//将后果保存到文件
$content = '';
foreach($result as $k => $v)
{
$content .= $k."n";
}
$fp = fopen('result.txt', 'w');
fwrite($fp, $content);
fclose($fp);
?>
20多行代码,就可能对百万以上的数据停止排重,效率也不错,十分适用。手机号、email,也可能采用这种模式停止排重。
还有,这可方法还可能用于两个文件停止排重的工作,假设你有两个uid列表文件,格式和上面的uid列表一样,示例程序如下:
//定义数组,用于寄存排重后的后果
$result = array();
//读取第一个uid列表文件,放入$result_1
$fp = fopen('test_1.txt', 'r');
while(!feof($fp))
{
$uid = fgets($fp);
$uid = trim($uid);
$uid = trim($uid, "r");
$uid = trim($uid, "n");
if($uid == '')
{
continue;
}
//以uid为key写入$result,如有反复就会笼罩
$result[$uid] = 1;
}
fclose($fp);
//读取第二个uid列表文件,并停止排重操作
$fp = fopen('test_2.txt', 'r');
while(!feof($fp))
{
$uid = fgets($fp);
$uid = trim($uid);
$uid = trim($uid, "r");
$uid = trim($uid, "n");
if($uid == '')
{
continue;
}
//以uid为key去看该值能否存在
if(empty($result[$uid]))
{
$result[$uid] = 1;
}
}
fclose($fp);
//$result里保存的就排重当前的后果,可能输出到文件,代码省略
?>