Warning: file_get_contents(/data/phpspider/zhask/data//catemap/5/date/2.json): failed to open stream: No such file or directory in /data/phpspider/zhask/libs/function.php on line 167

Warning: Invalid argument supplied for foreach() in /data/phpspider/zhask/libs/tag.function.php on line 1116

Notice: Undefined index: in /data/phpspider/zhask/libs/function.php on line 180

Warning: array_chunk() expects parameter 1 to be array, null given in /data/phpspider/zhask/libs/function.php on line 181
Random ElasticSearch每天都有一致的排序顺序,但每天都会随机化_Random_Hash_Cryptography_<img Src="//i.stack.imgur.com/RUiNP.png" Height="16" Width="18" Alt="" Class="sponsor Tag Img">elasticsearch - Fatal编程技术网 elasticsearch,Random,Hash,Cryptography,elasticsearch" /> elasticsearch,Random,Hash,Cryptography,elasticsearch" />

Random ElasticSearch每天都有一致的排序顺序,但每天都会随机化

Random ElasticSearch每天都有一致的排序顺序,但每天都会随机化,random,hash,cryptography,elasticsearch,Random,Hash,Cryptography,elasticsearch,我正试图返回一个随机的过滤查询结果,以使我的所有文档都有可能出现在第一页结果中。为了避免在重复搜索时混淆用户(并方便地支持分页),结果应在当天保持一致 为此,我开发了以下脚本排序查询。它将文档id(一个已经相当随机的guid)与daily salt(仅仅是一年中的某一天和当前年份的组合)相结合,并对结果进行哈希运算,以生成我期望的相当随机的字符串,该字符串只会随着“daily salt”每天的更改而更改(忽略此特定查询中的无关元素,它是由代码生成的) 灵感来自 它能工作,但不是很好。随着每日食盐

我正试图返回一个随机的过滤查询结果,以使我的所有文档都有可能出现在第一页结果中。为了避免在重复搜索时混淆用户(并方便地支持分页),结果应在当天保持一致

为此,我开发了以下脚本排序查询。它将文档id(一个已经相当随机的guid)与daily salt(仅仅是一年中的某一天和当前年份的组合)相结合,并对结果进行哈希运算,以生成我期望的相当随机的字符串,该字符串只会随着“daily salt”每天的更改而更改(忽略此特定查询中的无关元素,它是由代码生成的)

灵感来自

它能工作,但不是很好。随着每日食盐量的增加,我得到的结果略有不同,但同样的文档不断出现在顶部结果周围。它们稍微移动,但肯定有一个一致的模式

我已尝试将哈希函数更改为我发现的另一个哈希函数:
org.elasticsearch.cluster.routing.operation.hash.djb.DjbHashFunction.djb_hash
但它给出的结果与常见的顶级结果非常相似

我不是密码学专家,所以我认为这是一种常见哈希函数的行为,必须有一些特殊的哈希函数才能用于基于类似输入的更随机的结果

有熟悉ElasticSearch的人吗?我正在使用(云托管的弹性搜索服务),所以安装我自己的自定义功能不是一个选项

还是我从一个完全错误的角度看待这个问题

编辑 我只是查看了脚本生成的结果排序键,似乎脚本只应用于结果的第一页,然后对第一页进行排序(而不是应用于完整的结果集,从而更改第一页中的文档)

这是我的第一页结果(为了简洁而编辑)。但是您可以在第一页上看到,排序键在0c***到fa***之间变化,对于前0-20个文档,总共约200个文档

使用“dailySalt”=185-2013

{
"took": 2,
"timed_out": false,
"_shards": {
    "total": 1,
    "successful": 1,
    "failed": 0
},
"hits": {
    "total": 196,
    "max_score": null,
    "hits": [{
        "fields": {
            "id": "27662ef8-d2a7-4fde-80f6-1571b83c4cde"
        },
        "sort": ["0cbf8b4e7927f0a53a5b82f2630ff9ad"]
    }, {
        "fields": {
            "id": "d9b11797-053f-495e-a676-0ec959dba879"
        },
        "sort": ["0fa8730a5239f8a3d1286cbe16619bfa"]
    }, {
        "fields": {
            "id": "482c893f-1083-4860-892e-1b25cf442199"
        },
        "sort": ["295edd71cc48ac41c5e2f91315abf5ce"]
    }, {
        "fields": {
            "id": "581fd0f1-9ecb-4e5c-920b-06413bfbf4f7"
        },
        "sort": ["4b9f0d17bc2333d13a1963b4f6afb829"]
    }, {
        "fields": {
            "id": "de3dddb8-e296-4446-ac4c-135cc925669d"
        },
        "sort": ["4c5d0bcb50f5b600e539ba46b33b1007"]
    }, {
        "fields": {
            "id": "c83ad22e-80b4-40f1-8e56-2153a1a1f9e8"
        },
        "sort": ["55efe0a692ab3205405f1c74732b8205"]
    }, {
        "fields": {
            "id": "7bd19829-4f37-4e02-9fd1-0239b8ae8db4"
        },
        "sort": ["5adcd22c7c507244d7ba382812accdf3"]
    }, {
        "fields": {
            "id": "42fcec43-851f-4133-a8db-1d2bf0b86ec8"
        },
        "sort": ["6757f46bd554e3353a2ebf35c6b3d24c"]
    }, {
        "fields": {
            "id": "e119132b-4e93-4047-8513-1ce2452f0cdd"
        },
        "sort": ["6dbcb59a2b5e91523896d57695251b29"]
    }, {
        "fields": {
            "id": "7d0acf5d-7c14-45a2-97b7-17939ff512f4"
        },
        "sort": ["9d99752ec0802e55dcfb3c83bcd2e4bb"]
    }, {
        "fields": {
            "id": "2cdc21e4-3312-460b-9a18-094e4f95a56c"
        },
        "sort": ["9dc43d1d39e64cfe04c6d7b8f565faaa"]
    }, {
        "fields": {
            "id": "0f665cb3-5648-416c-b08f-146d2a019319"
        },
        "sort": ["b61bb718fe63a287b6fcdc8bcd638604"]
    }, {
        "fields": {
            "id": "1e852d49-2b3b-4d7a-9f1b-1495b94e723e"
        },
        "sort": ["ba7ad8a3a6e195a6bc28e341f9d6965b"]
    }, {
        "fields": {
            "id": "ca2a5922-bb42-4317-b61c-129925436a1f"
        },
        "sort": ["bca0411cf8d67b4dcd5b205a5010367f"]
    }, {
        "fields": {
            "id": "b1dac760-7d73-4b60-bd6d-08ea9453e68c"
        },
        "sort": ["be3714cfb2517e98d525aaea6e40cfa5"]
    }, {
        "fields": {
            "id": "c4b08def-59db-4ac0-b16f-0c3fae4c01f2"
        },
        "sort": ["c4220b31c305d536c7a7d1639da32c66"]
    }, {
        "fields": {
            "id": "cc7ac1fd-3e88-4503-a837-2000ebb6e2d9"
        },
        "sort": ["ceb5710fe2418fe3b353bf7b1f737570"]
    }, {
        "fields": {
            "id": "5a5f90c9-b44f-4ca2-9d16-117c8e9fd388"
        },
        "sort": ["dc5fea76598633cb08c1459983ebca62"]
    }, {
        "fields": {
            "id": "6d811d5b-4138-4a41-a186-1b9aa2b65623"
        },
        "sort": ["ea3c55ac123ac9e819b145402407d1de"]
    }, {
        "fields": {
            "id": "b489d2da-b4a1-44de-acde-219109edd42f"
        },
        "sort": ["fab53cc11983b45b081d4b01df555c59"]
    }]
}
}
MD5是一个函数,此类函数展示了一个名为的属性。简言之,即使是输入的一个小变化也会完全改变输出。例如,您可以使用在线MD5计算器进行实验

或者–你不会找到两个散列为相同值的字符串,即使你花了一生的时间试图找到它们

这两个属性保证您编写的脚本每天都为每个文档生成一个唯一的、随机的值。哈希函数不是这里的问题


有多少文件?每页显示多少个结果?你看到了什么样的图案?某个文档以随机方式出现在头版的可能性可能非常大。

因此,弹性搜索的脚本排序似乎存在问题。它只是将脚本应用于第一页的结果,然后仅对这一页进行排序。我在任何地方都找不到这种行为的文档记录,所以不确定这是一个bug还是出于性能原因而设计的

无论如何,使用一个查询,为score函数使用一个类似的脚本,可以得到所需的结果(由于速度的原因,我使用了DJB哈希而不是原始的MD5,它是为字符串设计的,并返回自定义score脚本所需的int):

是的,这就是我所想的(再雪崩效应),但不能用任何其他方式解释观察到的行为。每天显示约200个文档。每页20份文件。但我想我已经找到了问题的根源,请参阅我的编辑。它似乎源于ES应用排序的顺序,仅在运行查询并获得第一页结果后应用排序。这就是为什么我观察到第一页的结果在变化,但总是包含相同的文档。虽然这是一种奇怪的行为,但从ES的角度来看,不确定这样做在哪里有意义。。。
{
"took": 2,
"timed_out": false,
"_shards": {
    "total": 1,
    "successful": 1,
    "failed": 0
},
"hits": {
    "total": 196,
    "max_score": null,
    "hits": [{
        "fields": {
            "id": "27662ef8-d2a7-4fde-80f6-1571b83c4cde"
        },
        "sort": ["0cbf8b4e7927f0a53a5b82f2630ff9ad"]
    }, {
        "fields": {
            "id": "d9b11797-053f-495e-a676-0ec959dba879"
        },
        "sort": ["0fa8730a5239f8a3d1286cbe16619bfa"]
    }, {
        "fields": {
            "id": "482c893f-1083-4860-892e-1b25cf442199"
        },
        "sort": ["295edd71cc48ac41c5e2f91315abf5ce"]
    }, {
        "fields": {
            "id": "581fd0f1-9ecb-4e5c-920b-06413bfbf4f7"
        },
        "sort": ["4b9f0d17bc2333d13a1963b4f6afb829"]
    }, {
        "fields": {
            "id": "de3dddb8-e296-4446-ac4c-135cc925669d"
        },
        "sort": ["4c5d0bcb50f5b600e539ba46b33b1007"]
    }, {
        "fields": {
            "id": "c83ad22e-80b4-40f1-8e56-2153a1a1f9e8"
        },
        "sort": ["55efe0a692ab3205405f1c74732b8205"]
    }, {
        "fields": {
            "id": "7bd19829-4f37-4e02-9fd1-0239b8ae8db4"
        },
        "sort": ["5adcd22c7c507244d7ba382812accdf3"]
    }, {
        "fields": {
            "id": "42fcec43-851f-4133-a8db-1d2bf0b86ec8"
        },
        "sort": ["6757f46bd554e3353a2ebf35c6b3d24c"]
    }, {
        "fields": {
            "id": "e119132b-4e93-4047-8513-1ce2452f0cdd"
        },
        "sort": ["6dbcb59a2b5e91523896d57695251b29"]
    }, {
        "fields": {
            "id": "7d0acf5d-7c14-45a2-97b7-17939ff512f4"
        },
        "sort": ["9d99752ec0802e55dcfb3c83bcd2e4bb"]
    }, {
        "fields": {
            "id": "2cdc21e4-3312-460b-9a18-094e4f95a56c"
        },
        "sort": ["9dc43d1d39e64cfe04c6d7b8f565faaa"]
    }, {
        "fields": {
            "id": "0f665cb3-5648-416c-b08f-146d2a019319"
        },
        "sort": ["b61bb718fe63a287b6fcdc8bcd638604"]
    }, {
        "fields": {
            "id": "1e852d49-2b3b-4d7a-9f1b-1495b94e723e"
        },
        "sort": ["ba7ad8a3a6e195a6bc28e341f9d6965b"]
    }, {
        "fields": {
            "id": "ca2a5922-bb42-4317-b61c-129925436a1f"
        },
        "sort": ["bca0411cf8d67b4dcd5b205a5010367f"]
    }, {
        "fields": {
            "id": "b1dac760-7d73-4b60-bd6d-08ea9453e68c"
        },
        "sort": ["be3714cfb2517e98d525aaea6e40cfa5"]
    }, {
        "fields": {
            "id": "c4b08def-59db-4ac0-b16f-0c3fae4c01f2"
        },
        "sort": ["c4220b31c305d536c7a7d1639da32c66"]
    }, {
        "fields": {
            "id": "cc7ac1fd-3e88-4503-a837-2000ebb6e2d9"
        },
        "sort": ["ceb5710fe2418fe3b353bf7b1f737570"]
    }, {
        "fields": {
            "id": "5a5f90c9-b44f-4ca2-9d16-117c8e9fd388"
        },
        "sort": ["dc5fea76598633cb08c1459983ebca62"]
    }, {
        "fields": {
            "id": "6d811d5b-4138-4a41-a186-1b9aa2b65623"
        },
        "sort": ["ea3c55ac123ac9e819b145402407d1de"]
    }, {
        "fields": {
            "id": "b489d2da-b4a1-44de-acde-219109edd42f"
        },
        "sort": ["fab53cc11983b45b081d4b01df555c59"]
    }]
}
}
{
  "from": 0,
  "size": 20,
  "query": {
    "custom_score": {
      "script": "org.elasticsearch.cluster.routing.operation.hash.djb.DjbHashFunction.DJB_HASH(dailySalt + doc['id'].value)",
      "params": {
        "dailySalt": "185-2013"
      },
      "query": {
        "filtered": {
          "query": {
            "match_all": {}
          },
          "filter": {
            "bool": {
              "must": [
                {
                  "term": {
                    "tag_id": "Some Tag"
                  }
                },
                {
                  "match_all": {}
                }
              ]
            }
          }
        }
      }
    }
  },
  "fields": [
    "id"
  ]
}