一种面向特定领域的中文事件抽取方法

    公开(公告)号:CN108920447B

    公开(公告)日:2022-08-05

    申请号:CN201810426812.0

    申请日:2018-05-07

    摘要: 本发明一种面向特定领域的中文事件抽取方法,包括:预处理:对原始数据信息去除冗余标签、分句、分词;字典构建:人工对大规模新闻语料分析,对特定领域常见角色总结,构建角色字典;对报道特定领域事件的常见句型进行总结,构建基于触发词的句型字典;句法分析:对给定的中文新闻报道语句,进行句法解析得到句法解析树;句型匹配:根据句型字典在句法树上进行句型匹配;事件要素抽取:根据角色字典在句法树上进行角色抽取,根据时间和地点要素的句法特征在句法树上进行时间和地点抽取。本发明解决了大数据环境下快速获取中文新闻资讯信息的难题,通过自动化处理,用户根据自己输入关键词即可得到关键词相关的新闻事件,为信息获取提供极大便利。

    一种确定事件角色影响力指数的方法、装置及存储介质

    公开(公告)号:CN113313379A

    公开(公告)日:2021-08-27

    申请号:CN202110586002.3

    申请日:2021-05-27

    IPC分类号: G06Q10/06

    摘要: 本发明提供一种确定事件角色影响力指数的方法、装置及存储介质,包括:对各角色类别中的角色个体划分为一级指标和二级指标;根据角色类别及特定限制信息,提取所有满足所述限制信息的角色个体对应的二级指标中各指标的数值,计算并形成信息矩阵;对所提取形成的信息矩阵,利用熵权法计算二级指标的权重;针对二级指标权重利用变异系数法计算一级指标权重;将每个二级指标权重与其对应一级指标权重相乘,得到每个二级指标的综合权重;将目标角色个体的各二级指标对应的值与每个二级指标的综合权重相乘求和,得到所述目标角色个体的影响力指数。通过本发明的方法,能够计算出事件角色影响力,用于各领域角色影响力量化分析。