-
公开(公告)号:CN111046129A
公开(公告)日:2020-04-21
申请号:CN201910392857.5
申请日:2019-05-13
Applicant: 国家计算机网络与信息安全管理中心 , 北京蓝光汇智网络科技有限公司
IPC: G06F16/31 , G06F16/953 , G06Q50/00
Abstract: 本发明公开了基于文本内容特征的公众号信息存储方法,包括:采集公众号文章,提取公众号文章的唯一标识和特征文本,并将特征文本转化为特征标识,并将公众号文章与特征标识关联存储;根据公众号文章确定索引字段,建立索引字段与公众号文章的关联关系,生成索引数据,所述索引字段至少包括唯一标识;为多个索引节点分别配置唯一标识范围,将索引数据按照其唯一标识存储至相应的索引节点。本发明还提供了基于文本内容特征的公众号信息检索系统。本发明能够避免大量相同文章同时显示,并且能够保证检索系统的稳定性和效率。