发明名称 | 数据处理设备和数据处理方法 | ||
摘要 | 提供一种数据处理设备和数据处理方法。数据处理设备包括:获取装置,用于根据预定规则选择历史数据作为训练数据集并且将所述历史数据划分为子训练数据集和子测试数据集,根据所述子训练数据集中数据的属性或属性的组合获取关于数据类型的信息,并且针对每个数据类型,通过利用在该数据类型下去噪后的子训练数据集所训练的分类器对所述子测试数据集进行预测并验证预测结果,以获得具有最优预测结果的最优数据类型;以及训练数据集选择装置,通过在该最优数据类型下对所述训练数据集中的数据进行去噪,来获得类别比例满足预定条件的训练数据集,以通过利用该满足预定条件的训练数据集所训练的分类器对测试数据集进行分类。 | ||
申请公布号 | CN106033425A | 申请公布日期 | 2016.10.19 |
申请号 | CN201510106455.6 | 申请日期 | 2015.03.11 |
申请人 | 富士通株式会社 | 发明人 | 孙健;夏迎炬;杨铭 |
分类号 | G06F17/30(2006.01)I | 主分类号 | G06F17/30(2006.01)I |
代理机构 | 北京集佳知识产权代理有限公司 11227 | 代理人 | 王萍;尹莹莹 |
主权项 | 一种数据处理设备,所述数据处理设备包括:获取装置,用于根据预定规则选择历史数据作为训练数据集并且将所述历史数据划分为子训练数据集和子测试数据集,根据所述子训练数据集中数据的属性或属性的组合获取关于数据类型的信息,并且针对每个数据类型,通过利用在该数据类型下去噪后的子训练数据集所训练的分类器对所述子测试数据集进行预测并验证预测结果,以获得具有最优预测结果的最优数据类型;以及训练数据集选择装置,通过在该最优数据类型下对所述训练数据集中的数据进行去噪,来获得类别比例满足预定条件的训练数据集,以通过利用该满足预定条件的训练数据集所训练的分类器对测试数据集进行分类。 | ||
地址 | 日本神奈川县 |