我需要使用一个散列函数,该函数属于一个由k个独立散列函数组成的家族。C,C ++或python中任何库或工具包上的任何指针都可以生成一组k个独立的哈希函数,我可以从中选择一个函数。
背景:我正在尝试在此处实现此算法:http : //researcher.watson.ibm.com/researcher/files/us-dpwoodru/knw10b.pdf用于“不同元素”问题。
我看过这个线程:生成k个成对独立的哈希函数,其中提到使用Murmur哈希来生成成对独立的哈希函数。我想知道k方向独立哈希函数是否有任何相似之处。如果没有可用的方法,那么我有可能构造这样的一组k方向独立的哈希函数。
提前致谢。
我正在用Java编写一个minhashing算法,它要求我生成任意数量的随机散列函数(在我的情况下为240个散列函数),并通过它运行任意数量的整数(目前为2000).
为了做到这一点,我一直在为240个散列函数中的每一个生成随机数a,b和c(从1到2001的范围).然后,我的哈希函数返回h =((a*x)+ b)%c,其中h是返回值,x是通过它运行的整数之一.
这是随机散列的有效实现,还是有更常见/可接受的方式来实现它?
这篇文章提出了类似的问题,但我仍然对答案的措辞感到困惑: Minhash实现如何为排列找到哈希函数