【问题标题】:SuperFastHash returns different values for the same stringSuperFastHash 为同一个字符串返回不同的值
【发布时间】:2014-02-13 06:29:06
【问题描述】:

我正在尝试在一个小项目中使用 SuperFastHash,但我似乎无法理解为什么它会为同一字符串提供不同的哈希值。如果指针和字符串都相同,它只会输出相同的哈希。有任何想法吗?证明这一点的代码如下。

// SuperFastHash, taken from http://www.azillionmonkeys.com/qed/hash.html
#include <stdint.h>
#include <stdio.h>
#include <stdlib.h>

#undef get16bits
#if (defined(__GNUC__) && defined(__i386__)) || defined(__WATCOMC__) \
  || defined(_MSC_VER) || defined (__BORLANDC__) || defined (__TURBOC__)
#define get16bits(d) (*((const uint16_t *) (d)))
#endif

#if !defined (get16bits)
#define get16bits(d) ((((uint32_t)(((const uint8_t *)(d))[1])) << 8)\
                       +(uint32_t)(((const uint8_t *)(d))[0]) )
#endif

uint32_t SuperFastHash (const char * data, int len);

int main(void)
{
    char* str = "a\0a";
    printf("%s\n", &str[0]); // a
    printf("%s\n", &str[2]); // a
    printf("%i\n", SuperFastHash(&str[0], 25)); // -1120168156
    printf("%i\n", SuperFastHash(&str[2], 25)); // -280310739
}

uint32_t SuperFastHash (const char * data, int len) {
uint32_t hash = len, tmp;
int rem;

    if (len <= 0 || data == NULL) return 0;

    rem = len & 3;
    len >>= 2;

    /* Main loop */
    for (;len > 0; len--) {
        hash  += get16bits (data);
        tmp    = (get16bits (data+2) << 11) ^ hash;
        hash   = (hash << 16) ^ tmp;
        data  += 2*sizeof (uint16_t);
        hash  += hash >> 11;
    }

    /* Handle end cases */
    switch (rem) {
        case 3: hash += get16bits (data);
                hash ^= hash << 16;
                hash ^= ((signed char)data[sizeof (uint16_t)]) << 18;
                hash += hash >> 11;
                break;
        case 2: hash += get16bits (data);
                hash ^= hash << 11;
                hash += hash >> 17;
                break;
        case 1: hash += (signed char)*data;
                hash ^= hash << 10;
                hash += hash >> 1;
    }

    /* Force "avalanching" of final 127 bits */
    hash ^= hash << 3;
    hash += hash >> 5;
    hash ^= hash << 4;
    hash += hash >> 17;
    hash ^= hash << 25;
    hash += hash >> 6;

    return hash;
}

【问题讨论】:

    标签: c hash


    【解决方案1】:

    您的 len 参数 (25) 超过了可能应该为 1 的字符串大小。char* str = "a\0a" 的内存布局在这四个字符之后是 { 'a', 0, 'a', 0 },它是未定义的,很可能不是相同值的 23 倍(这当然会导致相等的哈希值)。 SuperFastHash 函数会忽略字符串终止符,它会计算您通过 len 参数定义的字符数。

    要查看功能是否正常,请尝试:

    #include <assert.h>
    
    int main(void)
    {
        char *buf = "abc\0abc";
        assert(SuperFastHash(&buf[0], 3) == SuperFastHash(&buf[4], 3));
        // etc.
    }
    

    【讨论】:

      【解决方案2】:

      如果我理解正确,您有一个单字符字符串,并且您正在散列该字符串的 25 个字符。所以它会读取你的字符和 NULL 字节,然后是 23 个字符的任何内容。

      【讨论】:

        猜你喜欢
        • 2015-10-01
        • 1970-01-01
        • 1970-01-01
        • 2015-07-07
        • 2016-09-25
        • 2019-08-30
        • 2016-01-10
        • 2019-11-30
        • 1970-01-01
        相关资源
        最近更新 更多