本发明公开了一种基于es倒排索引的化学分子式检索方法,本发明结合大数据平台对检索过程进行重新设计,首先通过对es数据库中的分子式进行分词得到的子结构建立倒排索引,并对es数据库中的分子式计算哈希表示;检索时对分子式进行分词得到子结构,并计算哈希表示,利用倒排索引得到子结构匹配的分子式集合,再与得到的分子式集合的哈希表示一一比较,得到输入分子式与分子式集合中每个分子式之间的相似度,按照应用需要输出检索结果。本发明的比较范围为分子式集合,而不是数据库中全部的分子式,减少了比较的次数,进一步加快了分子式的检索。
声明:
“基于es倒排索引的化学分子式检索方法” 该技术专利(论文)所有权利归属于技术(论文)所有人。仅供学习研究,如用于商业用途,请联系该技术所有人。
我是此专利(论文)的发明人(作者)