欢迎您访问程序员文章站本站旨在为大家提供分享程序员计算机编程知识!
您现在的位置是: 首页  >  IT编程

PHP Hash算法:Times33算法代码实例

程序员文章站 2023-11-13 11:04:34
最近看书,里面提到了一些hash算法。比较有印象的是times33,当时理解不是很透测,今天写了段程序来验证了一下。 先上代码: 复制代码 代码如下: <...

最近看书,里面提到了一些hash算法。比较有印象的是times33,当时理解不是很透测,今天写了段程序来验证了一下。
先上代码:

复制代码 代码如下:

<?php

/**
 * crc32 hash function
 * @param $str
 * @return int
 */
function hash32($str)
{
    return crc32($str) >> 16 & 0x7fffffff;
}

/**
 * times33 hash function
 * @param $str
 * @return int
 */
function hash33($str)
{
    $hash = 0;
    for($i=0; $i<strlen($str); $i++) {
        $hash += 33 * $hash + ord($str{$i});
    }
    return $hash & 0x7fffffff;
}


$n = 10;

// test case 1
$stat = array();
for($i=0; $i<10000; $i++){
    $str = substr(md5(microtime(true)), 0, 8);
    $p = hash32($str) % $n;
    if(isset($stat[$p])){
        $stat[$p]++;
    }else{
        $stat[$p] = 1;
    }
}
print_r($stat);

// test case 2
$stat = array();
for($i=0; $i<10000; $i++){
    $str = substr(md5(microtime(true)), 0, 8);
    $p = hash33($str) % $n;
    if(isset($stat[$p])){
        $stat[$p]++;
    }else{
        $stat[$p] = 1;
    }
}
print_r($stat);

以上有两个测试用例。第一个,用crc32的方法;第二个是times33的算法实现。

效果:

结果分布,两种算法不相上下(估计是数据源的问题,md5只有0-f)。也有文章说crc32的分布更均匀(参考链接:)
但耗费时间,crc32比times33快将近一倍。

为什么是33?

即是素数(质数),也是奇数。除了33,还有131, 1313, 5381等。php内置的hash函数用的是5381,在“鸟哥”的一篇博文中也有提到。