一种基于二元高斯非齐次泊松过程的单车数量预测方法

    公开(公告)号:CN109325625A

    公开(公告)日:2019-02-12

    申请号:CN201811141977.X

    申请日:2018-09-28

    Abstract: 本发明公开一种基于二元高斯非齐次泊松过程的单车数量预测方法,属于数据挖掘预测技术领域,根据单车站点历史数据,利用泊松理论,建立非齐次泊松模型,并考虑环境参数的影响,建立最终的预测模型,对时间序列进行模拟并对单车数量进行修正,只需要单车站点历史的单车使用数据就能进行预测,不仅能够在相应数据获取受限的情况下,实现站点单车数量的预测,且可减小天气等不实时更新数据对预测结果的影响,显著提高站点单车在未来的一段时间内的数量预测的准确性和及时性。

    基于伪负样本的数据平衡方法及提高数据分类性能的方法

    公开(公告)号:CN109272056B

    公开(公告)日:2021-09-21

    申请号:CN201811280097.0

    申请日:2018-10-30

    Abstract: 本发明公开了一种基于伪负样本的数据平衡方法及提高数据分类性能的方法,包括步骤:步骤1:正负样本分离,得到正样本集和负样本集;步骤2:计算得到负样本皮尔逊相关系数集合;步骤3:将伪负样本集和被挑选样本集初始化;步骤4:使用最大相关‑最小冗余方法计算权重,得到权重集合;步骤5:挑选出最大权重,更新伪负样本集和被挑选样本集;步骤6:重复步骤4和步骤5,直到挑选出伪负样本集;步骤7:将挑选出的伪负样本集并入正样本集,同时,从所述负样本集中剔除挑选出的伪负样本集;本发明首次提出并定义了伪负样本的概念,提出的算法可提高数据分类准确性,进而提高分类器性能,特别是在处理不平衡的生物信息数据方面优势明显。

    基于伪负样本的数据平衡方法及提高数据分类性能的方法

    公开(公告)号:CN109272056A

    公开(公告)日:2019-01-25

    申请号:CN201811280097.0

    申请日:2018-10-30

    Abstract: 本发明公开了一种基于伪负样本的数据平衡方法及提高数据分类性能的方法,包括步骤:步骤1:正负样本分离,得到正样本集和负样本集;步骤2:计算得到负样本皮尔逊相关系数集合;步骤3:将伪负样本集和被挑选样本集初始化;步骤4:使用最大相关-最小冗余方法计算权重,得到权重集合;步骤5:挑选出最大权重,更新伪负样本集和被挑选样本集;步骤6:重复步骤4和步骤5,直到挑选出伪负样本集;步骤7:将挑选出的伪负样本集并入正样本集,同时,从所述负样本集中剔除挑选出的伪负样本集;本发明首次提出并定义了伪负样本的概念,提出的算法可提高数据分类准确性,进而提高分类器性能,特别是在处理不平衡的生物信息数据方面优势明显。

Patent Agency Ranking