-
公开(公告)号:CN111597327B
公开(公告)日:2023-04-07
申请号:CN202010323594.5
申请日:2020-04-22
Applicant: 哈尔滨工业大学
IPC: G06F16/34 , G06F16/9532 , G06N3/0464 , G06N3/08 , G06F16/36
Abstract: 本发明公开了一种面向舆情分析的无监督式多文档文摘生成方法。步骤1:实时采集网络舆情新闻,根据网络热点进行新闻集合自动划分;步骤2:对集合内每个舆情新闻进行无监督式的抽取单文档文摘;步骤3:对集合内的所有抽取的单文档文摘进行分析,得到无监督式的多文档文摘。本发明解决现有多文档文摘方法效果较低、生成式文摘实用性较差、中文舆情文摘训练语料匮乏的问题,以实现对舆情新闻的监控。
-
公开(公告)号:CN111597327A
公开(公告)日:2020-08-28
申请号:CN202010323594.5
申请日:2020-04-22
Applicant: 哈尔滨工业大学
IPC: G06F16/34 , G06F16/9532 , G06N3/04 , G06N3/08 , G06F16/36
Abstract: 本发明公开了一种面向舆情分析的无监督式多文档文摘生成方法。步骤1:实时采集网络舆情新闻,根据网络热点进行新闻集合自动划分;步骤2:对集合内每个舆情新闻进行无监督式的抽取单文档文摘;步骤3:对集合内的所有抽取的单文档文摘进行分析,得到无监督式的多文档文摘。本发明解决现有多文档文摘方法效果较低、生成式文摘实用性较差、中文舆情文摘训练语料匮乏的问题,以实现对舆情新闻的监控。
-