发明名称 |
一种基于关键词的文本情感分类器的训练方法和分类方法 |
摘要 |
本发明提供一种基于关键词的文本情感分类器训练方法和分类方法,其中情感分类器训练方法包括下列步骤:1)在旧领域训练集和新领域测试集的文本的关键词中挑选枢纽特征;2)计算描述所述枢纽特征与所述旧领域训练集和新领域测试集的文本中词语的关系的矩阵W;3)由所述旧领域训练集和新领域测试集内的文本构成矩阵X,在映射空间X·W上训练分类器。根据本发明的文本情感分类方法对新领域的文本进行分类的精度更高。 |
申请公布号 |
CN101739430A |
申请公布日期 |
2010.06.16 |
申请号 |
CN200810227105.5 |
申请日期 |
2008.11.21 |
申请人 |
中国科学院计算技术研究所 |
发明人 |
谭松波;程学旗 |
分类号 |
G06F17/30(2006.01)I;G06K9/62(2006.01)I |
主分类号 |
G06F17/30(2006.01)I |
代理机构 |
北京泛华伟业知识产权代理有限公司 11280 |
代理人 |
王勇 |
主权项 |
一种基于关键词的文本情感分类器训练方法,包括下列步骤:1)在旧领域训练集和新领域测试集的文本的关键词中挑选枢纽特征;2)计算描述所述枢纽特征与所述旧领域训练集和新领域测试集的文本中词语的关系的矩阵W;3)由所述旧领域训练集和新领域测试集内的文本构成矩阵X,在映射空间X·W上训练分类器。 |
地址 |
100190 北京市海淀区中关村科学院南路6号 |