免费注册 查看新帖 |

Chinaunix

  平台 论坛 博客 文库
最近访问板块 发新帖
查看: 2133 | 回复: 6
打印 上一主题 下一主题

问一个字符串hash函数的问题,有技术含量! [复制链接]

论坛徽章:
0
跳转到指定楼层
1 [收藏(0)] [报告]
发表于 2010-06-24 11:23 |只看该作者 |倒序浏览
现在的一些字符串hash函数像ELF_hash,smdb_hash等都是32位的,也就是hash后的最大值是unsinged int的范围,由于现在数据量非常大,由200亿之多,所以hash之后的总数超出unsinged int的范围了,请问怎么修改这些hash函数,或者有没有其它方法,谢谢了!

论坛徽章:
0
2 [报告]
发表于 2010-06-24 11:45 |只看该作者
怎么没人关注了,再补充一下:

其实说白了,就是要做200亿个元素的hash,现在的hash函数范围是0~42亿,也就是说将200亿映射到42亿的空间,冲突肯定很多,请教各位有什么解决办法,本人曾想法,用多个hash表,将200亿的元素分成几部分,第一部分1~42亿的映射到第一个hash表中,42~84亿的映射到第二个表中,依次类推,不知道此法是否可行,还请各位指点一二,谢谢!

论坛徽章:
0
3 [报告]
发表于 2010-06-24 11:48 |只看该作者
要处理很大量的数据就不应该局限在32位处理器上,在64位系统下这些都不是问题。

论坛徽章:
0
4 [报告]
发表于 2010-06-24 11:55 |只看该作者
分段 不客气

论坛徽章:
0
5 [报告]
发表于 2010-06-24 11:55 |只看该作者
现在是在64位机器,就是hash函数不知道怎么处理。

论坛徽章:
324
射手座
日期:2013-08-23 12:04:38射手座
日期:2013-08-23 16:18:12未羊
日期:2013-08-30 14:33:15水瓶座
日期:2013-09-02 16:44:31摩羯座
日期:2013-09-25 09:33:52双子座
日期:2013-09-26 12:21:10金牛座
日期:2013-10-14 09:08:49申猴
日期:2013-10-16 13:09:43子鼠
日期:2013-10-17 23:23:19射手座
日期:2013-10-18 13:00:27金牛座
日期:2013-10-18 15:47:57午马
日期:2013-10-18 21:43:38
6 [报告]
发表于 2010-06-24 12:07 |只看该作者
也可以对一个元素分成两段计算hash,结果做相乘之类的,以扩大范围

论坛徽章:
15
射手座
日期:2014-11-29 19:22:4915-16赛季CBA联赛之青岛
日期:2017-11-17 13:20:09黑曼巴
日期:2017-07-13 19:13:4715-16赛季CBA联赛之四川
日期:2017-02-07 21:08:572015年亚冠纪念徽章
日期:2015-11-06 12:31:58每日论坛发贴之星
日期:2015-08-04 06:20:00程序设计版块每日发帖之星
日期:2015-08-04 06:20:00程序设计版块每日发帖之星
日期:2015-07-12 22:20:002015亚冠之浦和红钻
日期:2015-07-08 10:10:132015亚冠之大阪钢巴
日期:2015-06-29 11:21:122015亚冠之广州恒大
日期:2015-05-22 21:55:412015年亚洲杯之伊朗
日期:2015-04-10 16:28:25
7 [报告]
发表于 2010-06-24 12:26 |只看该作者
现在的一些字符串hash函数像ELF_hash,smdb_hash等都是32位的,也就是hash后的最大值是unsinged int的范围, ...
侧面bt 发表于 2010-06-24 11:23



    你可以自己做long long hash,64位的。
还可以 MD5 128位的,
还可以RSHA1,160位的
现在还出了256位的。自己网上搜搜。
您需要登录后才可以回帖 登录 | 注册

本版积分规则 发表回复

  

北京盛拓优讯信息技术有限公司. 版权所有 京ICP备16024965号-6 北京市公安局海淀分局网监中心备案编号:11010802020122 niuxiaotong@pcpop.com 17352615567
未成年举报专区
中国互联网协会会员  联系我们:huangweiwei@itpub.net
感谢所有关心和支持过ChinaUnix的朋友们 转载本站内容请注明原作者名及出处

清除 Cookies - ChinaUnix - Archiver - WAP - TOP