-
公开(公告)号:CN108829818B
公开(公告)日:2021-05-25
申请号:CN201810599385.6
申请日:2018-06-12
Applicant: 中国科学院计算技术研究所
IPC: G06F16/35
Abstract: 本发明提供了一种构建文本分类模型的方法。该方法包括以下步骤:根据文本信息的字、词语和句子的结构特征构建训练样本集,其中,所述训练样本集中的每一条样本数据对应一条文本信息关于词语的特征矩阵A、关于字的特征矩阵B和该条文本信息对应的类别向量O,O的维度与类别数量相同;以所述训练样本集中关于词语的特征矩阵A和关于字的特征矩阵B为输入,以对应的类别向量O为输出,训练深度学习模型,以获得文本分类模型。根据本发明构建的分类模型进行分类,能够提高文本分类的准确率,尤其适用于短文本分类。
-
公开(公告)号:CN109714209B
公开(公告)日:2021-03-09
申请号:CN201811633114.4
申请日:2018-12-29
Applicant: 中国科学院计算技术研究所
Abstract: 本发明涉及一种网站访问故障的诊断方法,包括获取网站性能指标数据,并根据所述指标数据执行常规诊断;根据所述常规诊断获得的常规诊断信息判定网站访问是否成功;若判定结果是网站访问失败,则进一步获取深度诊断信息数据,并根据所述深度诊断信息数据执行深度诊断。
-
公开(公告)号:CN109714209A
公开(公告)日:2019-05-03
申请号:CN201811633114.4
申请日:2018-12-29
Applicant: 中国科学院计算技术研究所
Abstract: 本发明涉及一种网站访问故障的诊断方法,包括获取网站性能指标数据,并根据所述指标数据执行常规诊断;根据所述常规诊断获得的常规诊断信息判定网站访问是否成功;若判定结果是网站访问失败,则进一步获取深度诊断信息数据,并根据所述深度诊断信息数据执行深度诊断。
-
公开(公告)号:CN103257923A
公开(公告)日:2013-08-21
申请号:CN201310131986.1
申请日:2013-04-16
Applicant: 中国科学院计算技术研究所 , 国家计算机网络与信息安全管理中心
IPC: G06F11/36
Abstract: 本发明公开了一种数据中心数据分析类基准测试程序的应用选取方法及系统,该方法执行于数据中心计算机系统中,包括:步骤一,从多种应用领域中分别选取至少一个应用,组成应用集,该应用集覆盖了特定种类的编程模型;步骤二,运行该应用集中的所有应用,针对每个应用,都分别获取预定性能指标的参数值;步骤三,将各个应用所对应的该参数值分别组成一个特征向量,对所有特征向量进行聚类;步骤四,在聚类得到的每个类中,选择距离类中心点最近和最远的两个应用作为基准测试程序的应用进行基准测试。
-
公开(公告)号:CN108829818A
公开(公告)日:2018-11-16
申请号:CN201810599385.6
申请日:2018-06-12
Applicant: 中国科学院计算技术研究所
IPC: G06F17/30
Abstract: 本发明提供了一种构建文本分类模型的方法。该方法包括以下步骤:根据文本信息的字、词语和句子的结构特征构建训练样本集,其中,所述训练样本集中的每一条样本数据对应一条文本信息关于词语的特征矩阵A、关于字的特征矩阵B和该条文本信息对应的类别向量O,O的维度与类别数量相同;以所述训练样本集中关于词语的特征矩阵A和关于字的特征矩阵B为输入,以对应的类别向量O为输出,训练深度学习模型,以获得文本分类模型。根据本发明构建的分类模型进行分类,能够提高文本分类的准确率,尤其适用于短文本分类。
-
公开(公告)号:CN108647730A
公开(公告)日:2018-10-12
申请号:CN201810456096.0
申请日:2018-05-14
Applicant: 中国科学院计算技术研究所
IPC: G06K9/62
Abstract: 本发明涉及机器分类领域,特别是一种利用历史交互数据共现进行的无人工参与的属性划分领域。本发明利用互联网长期的交互数据积累,从海量数据中获取信息,根据历史数据中多数人通过一定时间窗口内浏览、点击等交互行为中共同出现的物体、信息等,将这些物体、信息等通过无监督的技术手段进行归类,从而解决物体划分标准不统一、无划分规则或标准时很难划分、人工参与成本高的现有划分的三个难题,帮助需求方节省成本、创造价值的同时解决划分中遇到的问题。
-
公开(公告)号:CN108647730B
公开(公告)日:2020-11-24
申请号:CN201810456096.0
申请日:2018-05-14
Applicant: 中国科学院计算技术研究所
IPC: G06K9/62
Abstract: 本发明涉及机器分类领域,特别是一种利用历史交互数据共现进行的无人工参与的属性划分领域。本发明利用互联网长期的交互数据积累,从海量数据中获取信息,根据历史数据中多数人通过一定时间窗口内浏览、点击等交互行为中共同出现的物体、信息等,将这些物体、信息等通过无监督的技术手段进行归类,从而解决物体划分标准不统一、无划分规则或标准时很难划分、人工参与成本高的现有划分的三个难题,帮助需求方节省成本、创造价值的同时解决划分中遇到的问题。
-
公开(公告)号:CN103257923B
公开(公告)日:2016-12-28
申请号:CN201310131986.1
申请日:2013-04-16
Applicant: 中国科学院计算技术研究所 , 国家计算机网络与信息安全管理中心
IPC: G06F11/36
Abstract: 本发明公开了一种数据中心数据分析类基准测试程序的应用选取方法及系统,该方法执行于数据中心计算机系统中,包括:步骤一,从多种应用领域中分别选取至少一个应用,组成应用集,该应用集覆盖了特定种类的编程模型;步骤二,运行该应用集中的所有应用,针对每个应用,都分别获取预定性能指标的参数值;步骤三,将各个应用所对应的该参数值分别组成一个特征向量,对所有特征向量进行聚类;步骤四,在聚类得到的每个类中,选择距离类中心点最近和最远的两个应用作为基准测试程序的应用进行基准测试。
-
-
-
-
-
-
-