一种基于异质数据的人物相似度刻画方法

    公开(公告)号:CN107577782B

    公开(公告)日:2021-04-30

    申请号:CN201710827978.9

    申请日:2017-09-14

    Abstract: 本发明公开了一种基于异质数据的人物相似度刻画方法,属于数据挖掘领域。本发明首先搜集用户的微博文本,获取用户之间的关注关系以及各用户的基本信息,针对不同类型数据的特点个性化选择处理方式,并对于微博文本采用Doc2vec模型,结合上下文信息将文本表示成向量,再根据定义的相似度函数衡量相似度,最后将不同维度得到的矩阵进行融合,刻画用户最终的相似度。本发明引入了多种社交网络信息,包括社交关系数据、用户属性数据和用户文本数据等,通过对不同类型的信息加以综合考虑,以得到更全面的人物相似度刻画方法;同时本发明提供了对于多种数据的处理和计算方案,利用完整的数据和加权融合方法,个性化计算不同偏好的人物相似度。

    新闻事件信息归纳方法
    63.
    发明授权

    公开(公告)号:CN109960756B

    公开(公告)日:2021-04-09

    申请号:CN201910207437.5

    申请日:2019-03-19

    Abstract: 本发明公开了一种新闻事件信息归纳方法,包括:收集新闻素材,创建新闻库;从新闻库中获取目标事件的所有新闻文本,并进行热度分析,获取拐点新闻文本,抽取所述拐点新闻文本中的事件信息并保存;其中,获取拐点新闻文本的方法包括:统计所有新闻文本的热度值,按照新闻文本发布的时间顺序排序,构建热度值随时间变化的曲线图,取曲线图的所有极大点对应的新闻文本,即为所述拐点新闻文本,所述热度值为新闻的页面浏览量和网站独立访客量之和。本发明的方法通过选择对于目标新闻事件处于关键节点时的新闻文本——即拐点新闻文本进行摘要分析处理,准确地反映了新闻事件的发展态势。

    一种基于异构图注意力神经网络的暗网线索检测方法

    公开(公告)号:CN111737551A

    公开(公告)日:2020-10-02

    申请号:CN202010452949.0

    申请日:2020-05-26

    Abstract: 本发明公开一种基于异构图注意力神经网络的暗网线索检测方法:步骤一、对暗网进行文本采集;步骤二、针对采集到的暗网文本信息,进行事件标题、关键词及实体提取,构建动态异构信息网络;步骤三、对构建的异构信息网络中的节点进行embedding处理,并得到各节点的特征向量;步骤四、对异构信息网络的图结构进行学习;步骤五、根据对异构信息网络的图结构学习得到的结果,对异构信息网络中的节点进行线索类别分类,从而完成对暗网信息的线索检测。本发明利用了外部知识库作为依托,并且采用了两套方法来对构建的异构信息网络的图结构进行学习,具有良好的线索检测效果。

    基于机器学习的微信公众号推荐算法及系统

    公开(公告)号:CN110990711A

    公开(公告)日:2020-04-10

    申请号:CN201910392858.X

    申请日:2019-05-13

    Abstract: 本发明公开了基于机器学习的微信公众号推荐算法,包括:为训练文本标注标签,获取训练文本的关键词及关键词向量,对关键词向量进行聚类计算,获得簇,并确定簇的中心向量;采集公众号文本,获取公众号文本的关键词及关键词向量,根据关键词向量与中心向量的相似度确定公众号文本对应的标签,获得标签分析结果;根据目标用户的历史行为确定目标用户的喜好标签;从标签分析结果中选取与喜好标签相关的标签,将相关的标签对应的公众号文本推荐给目标用户。本发明还提供了基于机器学习的微信公众号推荐系统。本发明能够根据分析用户喜好,进而自动推荐合适的公众号,避免用户受各种良莠不齐的公众号干扰,避免花费过多时间用于挑选公众号文章。

    基于知识图谱的舆情关联分析方法及系统

    公开(公告)号:CN110413784A

    公开(公告)日:2019-11-05

    申请号:CN201910666645.1

    申请日:2019-07-23

    Abstract: 本发明公开了一种基于知识图谱的舆情关联分析方法,包括:提取互联网舆情知识中实体的属性和关系,基于知识图谱构建舆情业务知识库;确定需要关联分析的多个相同或不同类型的实体,采用相交、合并或者消减的方式对多个相同或不同类型的实体进行组合;确定多个相同或不同类型的实体每种组合方式进行关联分析的结果构成,得到分析结果。本发明还提供一种基于知识图谱的舆情关联分析系统。本发明可以实现包括特定人物、特定组织、特定事件、特定专题等在内的相同类型或不同类型知识的关联分析,并实现关联实体的多维度深度分析和关联挖掘,帮助业务用户准确掌握各类不同群体的关联情况,以及关联实体的全方位智能分析结果,进而辅助决策。

Patent Agency Ranking