-
公开(公告)号:CN109359301A
公开(公告)日:2019-02-19
申请号:CN201811219240.5
申请日:2018-10-19
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06F17/27 , G06F16/35 , G06F16/958
Abstract: 本发明公开了一种网页内容的多维度标注方法及装置,该方法包括:将待标注的网页内容文本转换为词向量;根据词向量,进行卷积神经网络分类,并将分类结果作为第一类维度标注结果;对待标注的网页内容进行第二类维度实体识别,得到第二类维度实体词;构建第二类维度规则知识库;将第二类维度实体词与第二类维度规则知识库进行匹配,得到第二类维度标注结果。本发明从网页的内容出发,利用有监督的深度学习分类方法卷积神经网络对第一类维度进行标注,解决了传统基于词频统计分类方法分类准确率低的问题;利用命名实体识别和规则知识库对第二类维度进行标注,丰富了网页的标注内容,提升了用户体验。
-
公开(公告)号:CN109241438A
公开(公告)日:2019-01-18
申请号:CN201811128658.5
申请日:2018-09-27
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06F16/9535 , G06F17/27
Abstract: 本发明公开了一种基于要素的跨通道热点事件发现方法、装置及存储介质,本发明融合某一领域的新闻报道数据与微博数据,通过联合两个通道提取的要素与文本语义相似度分析,有利于发现该领域热点事件,并且更全面细致的了解热点事件。
-
公开(公告)号:CN107545508A
公开(公告)日:2018-01-05
申请号:CN201610474035.8
申请日:2016-06-24
Applicant: 国家计算机网络与信息安全管理中心 , 中国科学院声学研究所
IPC: G06Q50/00
Abstract: 本发明提供了一种基于社区结构的集体预测方法,所述方法包括:步骤1)遍历网络V中的每个节点,利用社区模块度指标生成若干个社区,每个节点归属于其中一个社区;步骤2)利用网络V中已知标签的节点自身的特征向量和社区结构向量训练预测模型;步骤3)计算所有未知标签节点的自身特征向量和社区结构向量,输入预测模型获取所有未知标签节点的标签和概率;反复进行该步骤,直至所有未知标签节点的标签不再发生改变,输出所有未知标签节点的最终标签和概率。本发明的方法能够提高社区结构中节点标签的预测的正确率。
-
公开(公告)号:CN107515889A
公开(公告)日:2017-12-26
申请号:CN201710531249.9
申请日:2017-07-03
Applicant: 国家计算机网络与信息安全管理中心
CPC classification number: G06F17/30867 , H04L51/16 , H04L51/32
Abstract: 本发明公开了一种微博话题实时监测方法与系统。该方法包括:获取预定时间段内预定话题对应的全部微博数据;统计全部微博数据中预定特征信息的数量;确定预定特征信息的数量在预定特征信息对应的预定高斯分布模型中所处的数量区间范围;根据预定特征信息的数量在其对应的预定高斯分布模型中所处的数量区间范围确定预定话题是否异常。本发明通过确定被监测话题在预定时间段内的预定特征信息的数量在其对应的预定高斯分布模型中所处的数量区间范围来确定被监测话题是否异常,考虑到用户使用微博的时间习惯以及历史同期数据分布情况,排除了周期性活动的干扰,确保异常判断结果的准确性和可靠性。
-
公开(公告)号:CN105207843A
公开(公告)日:2015-12-30
申请号:CN201510535106.6
申请日:2015-08-27
Applicant: 国家计算机网络与信息安全管理中心
IPC: H04L12/26
Abstract: 本发明提出了一种网站访问质量检测方法。其包括:在一测试时间段内进行多次随机测试,累计得到对应该测试时间段的历史测试结果;基于用户指定的先验分布和所述历史测试结果,选取被测网站和测试路径,以用于下一测试时间段的有效测试,可以有效挑选测试对象,优化测试策略,提高质量检测的效率。
-
公开(公告)号:CN104881458A
公开(公告)日:2015-09-02
申请号:CN201510266108.X
申请日:2015-05-22
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06F17/30
CPC classification number: G06F16/374 , G06F16/35
Abstract: 本发明公开了一种网页主题的标注方法和装置。所述方法包括:基于网页的标题和正文,获得所述网页的主题特征向量;利用预先训练获得的分类器,对所述主题特征向量进行分类处理;判断是否存在所述主题特征向量所属的类型;若是,则将所述网页标注为所述主题特征向量所属的类型;若否,则将所述网页标记为待标注网页;进一步地,对多个待标注网页进行聚类处理;分析出每个聚类集合的类型;将待标注网页标注为其所属的聚类集合的类型。本发明采用有监督的分类方法和无监督的聚类方法级联的方式,自动的从网页中获取主题并标注网页,有效提高了网页主题标注的效率和准确性。
-
公开(公告)号:CN104850947A
公开(公告)日:2015-08-19
申请号:CN201510229723.3
申请日:2015-05-07
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06Q10/06
Abstract: 本发明公开了一种网格化多业务流程统一管理方法及装置,包括:基于待处理的业务建立相应的业务处理流程,并通过业务处理流程触发与多个业务系统进行信息交互,实现业务处理流程自动与外部系统交互,从而在业务流程管理中实现与多个业务系统的自动化交互操作。
-
公开(公告)号:CN104850647A
公开(公告)日:2015-08-19
申请号:CN201510284124.1
申请日:2015-05-28
Applicant: 国家计算机网络与信息安全管理中心
CPC classification number: G06F16/951 , G06Q50/01
Abstract: 本发明公开了一种微博团体的发现方法及装置,其中,该方法包括:根据微博用户的元信息及微博内容,构建相互独立的特征信息词典;从预定时间段内用户的元信息和微博内容中分词,并基于特征信息词典和提取到的词语确定用户的兴趣特征向量;采用无监督学习方式从兴趣特征向量中确定用户团体信息。本发明实施例为不同种类的信息建立各自独立的特征信息词典,从用户一定时间段内更新的信息中分词,来与特征信息词典中的词语进行比对,进而确定用户的兴趣特征向量,再通过无监督学习方式来确定用户团体信息,通过此过程确定的用户团体信息是具有相同或相似兴趣爱好的团体,具有更准确的推广意义,传播力度大大提高,解决了现有问题。
-
-
-
-
-
-
-