数据处理方法及装置
    3.
    发明公开

    公开(公告)号:CN116467427A

    公开(公告)日:2023-07-21

    申请号:CN202310323580.7

    申请日:2023-03-29

    Abstract: 本申请提供一种数据处理方法及装置,所述方法包括:得到原始医学知识数据集对应的各类簇;对所述各类簇进行离群检测处理,如果类簇中数据点的总数小于设定阈值或类簇中不包含标签为医学教材的医学数据,则将类簇中的所有医学数据放入离群点候选集中;根据离群点候选集中数据点的标签对所述离群点候选集进行剪枝处理;对剪枝后的离群点候选集中的数据点进行离群处理。本发明实施例提供的数据处理方法及装置,通过专门适用于该应用场景的改进聚类和离群算法,对原始医学知识数据中的离群数据进行筛选处理,还通过专门适用于该应用场景数据特点的剪枝算法,既保证离群处理的计算效率,也最大限度地保留了可用的医学知识数据。

    数据处理方法及装置
    4.
    发明公开

    公开(公告)号:CN115292303A

    公开(公告)日:2022-11-04

    申请号:CN202211221664.1

    申请日:2022-10-08

    Abstract: 本发明公开了一种数据处理方法及装置,该方法包括:对数据集中的数据进行聚类,得到各类簇;对各类簇进行离群检测处理,所述离群检测处理包括:如果所述类簇中数据点的总数小于设定阈值,则将所述类簇中的所有数据点放入离群点候选集中;否则,依次计算所述类簇中各数据点到类簇中心的距离,并将所述距离大于等于半径的数据点放入离群点候选集中;对所述离群点候选集进行剪枝处理,得到剪枝后的离群点候选集;对剪枝后的离群点候选集中的数据点进行离群处理,确定数据点是否为离群点。利用本发明方案,可以有效提升大数据的数据质量。

    一种基于可信空间的可信数据交换方法、装置及存储介质

    公开(公告)号:CN119227120B

    公开(公告)日:2025-04-04

    申请号:CN202411779051.9

    申请日:2024-12-05

    Abstract: 本申请公开了一种基于可信空间的可信数据交换方法、装置及存储介质。本申请方法包括:数据提供方将数据上传至可信数据空间;数据供给平台生成合约,合约包含签约时间戳、数据标识符、数据提供方标识符、数据使用方标识符、使用权限、使用期限、数据修改限制和控制策略;对合约信息进行哈希加密,并将合约信息存储于目标区块链中;将摩斯码中的“点”、“横”及“间隔”分别映射为零宽度非连接符、零宽度连接符及零宽度空格符,将加密后的合约标识符转换为摩斯码格式;在上传的数据信息的随机位置嵌入零宽度非连接符、零宽度连接符及零宽度空格符,加密秘钥基于预设的加密算法生成;使用加密密钥对上传的数据信息进行加密。

    企业所属产业预测方法、装置、电子设备和存储介质

    公开(公告)号:CN119047663A

    公开(公告)日:2024-11-29

    申请号:CN202411545688.1

    申请日:2024-11-01

    Abstract: 本发明提供了一种企业所属产业预测方法、装置、电子设备和存储介质,方法包括:确定待预测企业对应的目标实体,目标实体的类型为企业;根据目标实体,从预先生成的企业知识图谱中查找目标实体对应的相关实体,企业知识图谱包括多个不同类型的实体、各实体之间的关系和各实体的属性,相关实体与目标实体之间具有关系,且相关实体的类型为产业;根据相关实体,获取待预测企业所属产业,将分散的企业相关知识信息整合成结构化的知识图谱,并通过推理各实体之间的隐性关系,并补全企业知识图谱,使得企业知识图谱能够反映更深层次的隐藏信息,进而可以利用企业知识图谱,查找与待预测企业的目标实体对应的相关实体,对企业所属产业进行准确预测。

Patent Agency Ranking