-
公开(公告)号:CN118520929B
公开(公告)日:2024-10-29
申请号:CN202411003497.2
申请日:2024-07-25
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06N3/09 , G06N3/0455 , G06F40/194
Abstract: 本发明提供一种文本相似度确定模型的训练方法及文本相似度计算方法,属于计算机技术领域,该训练方法包括:获取第一数据集和第二数据集;第一数据集中包括至少一个短文本数据对;第二数据集中包括至少一个目标文本数据对,目标文本数据对中的两个目标文本数据至少一个为长文本数据;基于句向量对比模型,获取第二数据集中各目标文本数据的关键表述;句向量对比模型是基于第一数据集和第一损失函数对第一预训练模型训练得到的;基于各关键表述和第二损失函数,对第二预训练模型进行训练,得到文本相似性确定模型。通过在判定过程中引入短文本和长文本,提升了文本相似度确定模型输出结果的准确性。
-
公开(公告)号:CN116992128A
公开(公告)日:2023-11-03
申请号:CN202310761657.9
申请日:2023-06-26
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06F16/9535 , G06F18/24 , G06Q10/0639
Abstract: 本申请公开了一种检测推荐系统的推荐结果多样性的方法及设备,包括:获取所述推荐系统的推荐结果,并基于预设主题分类模型对所述推荐结果进行分类,以获得推荐内容的主题类别;确定推荐内容的主题类别中,相似的主题内容,通过预设情感立场检测模型进行情感立场检测;根据情感立场检测结果,计算考虑情感立场多样性的多样性评价指标。本申请的方法将情感立场维度的多样性融入到推荐系统多样性指标中,由此提出了一种考虑了情感立场多样性的推荐系统多样性检测方法。
-
公开(公告)号:CN116881550A
公开(公告)日:2023-10-13
申请号:CN202310764113.8
申请日:2023-06-26
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06F16/9535 , G06F18/23213 , G06F9/445 , G06F21/56 , G06N3/04 , G06N3/08
Abstract: 本申请公开了一种内容推荐系统冷启动安全风险检测方法及装置,包括:对被测推荐系统,根据所述被测推荐系统的注册规则,生成用户画像,并根据生成的用户画像、在本地系统构建相应的用户;为任一用户,基于配置的交互策略,在所述本地系统执行交互;根据交互结果构建训练数据;将训练数据输入潜在特征学习模型,执行训练;对所述待检测的内容数据,输入训练好的潜在特征学习模型;统计并逆向排序所述潜在特征学习模型的输出结果的重构误差;取排序后前指定数量的输出数据作为异常数据、进行聚类;根据聚类结果,判断内容推荐系统冷启动是否存在安全风险。本申请的方法能够用于判别被测推荐系统在冷启动阶段是否被恶意操纵。
-
公开(公告)号:CN115438239A
公开(公告)日:2022-12-06
申请号:CN202110623899.2
申请日:2021-06-04
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06F16/9035 , G06F16/906
Abstract: 本发明公开一种自动化异常样本筛选的异常检测方法及装置,包括依据数据集中各数据的特征,进行数据筛选;对筛选得到的数据进行特征降维;针对特征降维后的数据进行异常检测,得到若干候选数据;对所有候选数据作聚类,得到带类别标签的异常数据。本发明利用特征筛选和特征降维方法,解决异常检测算法难以处理高维度特征的问题,并结合对异常检验算法和聚类算法,实现了对异常样本的自动化分析,在整个流程中不需要人工干预,大大减少了异常样本发现与分析过程中的人力投入。
-
公开(公告)号:CN118520929A
公开(公告)日:2024-08-20
申请号:CN202411003497.2
申请日:2024-07-25
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06N3/09 , G06N3/0455 , G06F40/194
Abstract: 本发明提供一种文本相似度确定模型的训练方法及文本相似度计算方法,属于计算机技术领域,该训练方法包括:获取第一数据集和第二数据集;第一数据集中包括至少一个短文本数据对;第二数据集中包括至少一个目标文本数据对,目标文本数据对中的两个目标文本数据至少一个为长文本数据;基于句向量对比模型,获取第二数据集中各目标文本数据的关键表述;句向量对比模型是基于第一数据集和第一损失函数对第一预训练模型训练得到的;基于各关键表述和第二损失函数,对第二预训练模型进行训练,得到文本相似性确定模型。通过在判定过程中引入短文本和长文本,提升了文本相似度确定模型输出结果的准确性。
-
公开(公告)号:CN118277914A
公开(公告)日:2024-07-02
申请号:CN202311471891.4
申请日:2023-11-07
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06F18/2431 , G06F18/24 , G06F18/213 , G06F18/22
Abstract: 本发明涉及APP分类分析技术领域,公开了一种基于动静结合多维度APK特征的移动应用分类方法,首先进行APP特征构建,基于主流手机应用商店、互联网小型分发平台、APP传播页面对APP的信息进行采集,具体通过APP所提供的功能或呈现的信息内容,识别APP的业务分类,采集通信类的信息,形成初始的测试数据集;再基于APP源码进行分析,获取APP的静态源码特征、动态流量和页面特征数据,具体包括名称、流量和内容信息;进行建立规则匹配模型和匹配机制,具体通过构建定时扫描程序,通过预设的各分类规则匹配模型进行识别和研判。本发明对具有显著技术特征或内容特征的APP具有较高的识别准确率,降低人工审核参与度。
-
公开(公告)号:CN116056087B
公开(公告)日:2023-06-09
申请号:CN202310334691.8
申请日:2023-03-31
Applicant: 国家计算机网络与信息安全管理中心
IPC: H04W12/122 , H04W12/00 , H04W84/18
Abstract: 本申请提供一种网络攻击检测方法、装置及设备,涉及人工智能技术领域。该方法包括:在确定无线自组网未受到已知类型网络攻击的情况下,将所述无线自组网中各节点之间的收发数据输入至第一网络攻击检测模型中,获取所述无线自组网的检测结果,所述检测结果为受到未知类型网络攻击或者未受到网络攻击;其中,所述第一网络攻击检测模型是基于未受到网络攻击的多个第一收发数据样本和多个虚假收发数据样本对初始第一网络攻击检测模型进行训练得到的,所述虚假收发数据样本为受到未知类型网络攻击的收发数据样本。本申请的方案,能够实现未知类型网络攻击的检测。
-
公开(公告)号:CN116094734A
公开(公告)日:2023-05-09
申请号:CN202310364237.7
申请日:2023-04-07
Applicant: 国家计算机网络与信息安全管理中心
IPC: H04L9/32 , H04W4/40 , H04W12/0431 , H04W12/069 , H04W84/18
Abstract: 本发明提供一种基于区块链的车辆身份信息处理方法及系统,涉及车联网技术领域,基于区块链的车辆身份信息处理方法,应用于第一运营节点,包括:接收目标车辆节点发送的车辆身份信息;利用目标区块链对应的共识机制,对车辆身份信息进行身份认证,若身份认证成功,基于车辆身份信息生成数字证书;将数字证书发送到目标区块链的各第二运营节点,并接收各第二运营节点反馈的核验结果;在核验结果为通过的情况下,确定目标车辆节点加入目标区块链。利用区块链公开透明的特点,打破了互通互信的壁垒,运营主体之间实现了安全通信,同时也解决了车载自组织网中的身份认证问题,避免用户信息泄露。
-
公开(公告)号:CN119600625A
公开(公告)日:2025-03-11
申请号:CN202510143447.2
申请日:2025-02-10
Applicant: 国家计算机网络与信息安全管理中心
Abstract: 本发明涉及自然语言处理技术领域,提供一种变体词识别方法及装置,所述方法包括:对待识别文本进行分词,得到至少一个文本分词;对各文本分词进行文本图像生成,得到各文本分词对应的分词图像;基于各文本分词的编码特征,以及对应分词图像的编码特征,得到各文本分词的变体词识别结果。本发明结合各文本分词的编码特征以及对应分词图像的编码特征,可以融合文本语义与视觉细节信息,将文本模态的文本分词和图像模态的分词图像对齐到同一语义空间,更全面地理解和识别变体词,有效提升了变体词识别的准确率。
-
公开(公告)号:CN118277914B
公开(公告)日:2025-01-24
申请号:CN202311471891.4
申请日:2023-11-07
Applicant: 国家计算机网络与信息安全管理中心
IPC: G06F18/2431 , G06F18/24 , G06F18/213 , G06F18/22
Abstract: 本发明涉及APP分类分析技术领域,公开了一种基于动静结合多维度APK特征的移动应用分类方法,首先进行APP特征构建,基于主流手机应用商店、互联网小型分发平台、APP传播页面对APP的信息进行采集,具体通过APP所提供的功能或呈现的信息内容,识别APP的业务分类,采集通信类的信息,形成初始的测试数据集;再基于APP源码进行分析,获取APP的静态源码特征、动态流量和页面特征数据,具体包括名称、流量和内容信息;进行建立规则匹配模型和匹配机制,具体通过构建定时扫描程序,通过预设的各分类规则匹配模型进行识别和研判。本发明对具有显著技术特征或内容特征的APP具有较高的识别准确率,降低人工审核参与度。
-
-
-
-
-
-
-
-
-