-
公开(公告)号:CN112905872B
公开(公告)日:2023-10-13
申请号:CN201911136466.3
申请日:2019-11-19
Applicant: 百度在线网络技术(北京)有限公司
IPC: G06F16/9535 , G06F16/9537 , G06F16/35 , G06F16/36 , G06Q30/0251 , G06Q30/0601 , H04L67/55 , H04L67/306
Abstract: 本申请公开了一种意图识别方法、装置、设备和可读存储介质,涉及数据挖掘技术领域。具体实现方案为:获取多个用户的意图表达行为,并提取所述意图表达行为所关联的内容;从所述内容中识别每个用户的意图特征;根据所述意图特征对所述多个用户进行聚类,得到多个子群体以及每个子群体的群体意图特征。本申请实施例基于意图表达行为智能识别用户的意图特征;基于特征聚类的方式,对多个用户进行群体划分,得到每个子群体的群体意图特征,从而通过多个用户的意图表达行为最终得到群体意图特征,能够在用户实际行为之前识别用户意图,能够有效提高后续营销的效率。
-
公开(公告)号:CN103268361B
公开(公告)日:2019-05-31
申请号:CN201310226579.9
申请日:2013-06-07
Applicant: 百度在线网络技术(北京)有限公司 , 南开大学
IPC: G06F16/955
Abstract: 本发明提出一种网页中隐藏动态统一资源定位符URL的提取方法、装置和系统,其中该方法包括以下步骤:获取并加载网页;对网页进行分析以提取网页中的JavaScript脚本中的事件句柄代码;以及通过JavaScript引擎加载事件句柄代码,并根据加载结果获取网页中隐藏的URL。根据本发明实施例方法,一方面在对网站进行安全测试时可以覆盖更多的隐藏在网页中的URL,提高了安全测试的效率和覆盖率,另一方面可以将本发明的方法提供给网络爬虫,网络爬虫通过获取的页面中隐藏的URL可以更深层次的挖掘网络中的信息,提升了网络爬虫的网络覆盖率。
-
公开(公告)号:CN103268361A
公开(公告)日:2013-08-28
申请号:CN201310226579.9
申请日:2013-06-07
Applicant: 百度在线网络技术(北京)有限公司
IPC: G06F17/30
Abstract: 本发明提出一种网页中隐藏动态统一资源定位符URL的提取方法、装置和系统,其中该方法包括以下步骤:获取并加载网页;对网页进行分析以提取网页中的JavaScript脚本中的事件句柄代码;以及通过JavaScript引擎加载事件句柄代码,并根据加载结果获取网页中隐藏的URL。根据本发明实施例方法,一方面在对网站进行安全测试时可以覆盖更多的隐藏在网页中的URL,提高了安全测试的效率和覆盖率,另一方面可以将本发明的方法提供给网络爬虫,网络爬虫通过获取的页面中隐藏的URL可以更深层次的挖掘网络中的信息,提升了网络爬虫的网络覆盖率。
-
公开(公告)号:CN112905872A
公开(公告)日:2021-06-04
申请号:CN201911136466.3
申请日:2019-11-19
Applicant: 百度在线网络技术(北京)有限公司
IPC: G06F16/9535 , G06F16/35 , G06F16/36 , G06Q30/02 , G06Q30/06
Abstract: 本申请公开了一种意图识别方法、装置、设备和可读存储介质,涉及数据挖掘技术领域。具体实现方案为:获取多个用户的意图表达行为,并提取所述意图表达行为所关联的内容;从所述内容中识别每个用户的意图特征;根据所述意图特征对所述多个用户进行聚类,得到多个子群体以及每个子群体的群体意图特征。本申请实施例基于意图表达行为智能识别用户的意图特征;基于特征聚类的方式,对多个用户进行群体划分,得到每个子群体的群体意图特征,从而通过多个用户的意图表达行为最终得到群体意图特征,能够在用户实际行为之前识别用户意图,能够有效提高后续营销的效率。
-
-
-