发明名称 |
微博客数据采集方法及系统 |
摘要 |
本发明提供了一种基于用户分类的微博客数据采集方法。该方法首先初始化用户进行用户分类的数据;对获得的用户特征进行提取,取得可用于进行用户确定的特征数据;对提取出的数据进行过滤,多过滤后的数据根据特征之间的关系进行用户类型确定;对不同类别的用户采用不同的策略进行数据采集。该方法能够保证微博客数据采集的完整性和实时性,并能进行自适应的调整,以适应网络数据的变化。 |
申请公布号 |
CN102609460A |
申请公布日期 |
2012.07.25 |
申请号 |
CN201210011178.7 |
申请日期 |
2012.01.13 |
申请人 |
中国科学院计算技术研究所 |
发明人 |
程学旗;房伟伟;李静远;陈根宝;邢国亮;张凯;方滨兴 |
分类号 |
G06F17/30(2006.01)I |
主分类号 |
G06F17/30(2006.01)I |
代理机构 |
北京泛华伟业知识产权代理有限公司 11280 |
代理人 |
王勇 |
主权项 |
一种微博客数据采集方法,该方法包括:步骤1)采集初始的用户数据;步骤2)从用户数据中提取用户特征;步骤3)根据用户特征来确定用户的类型;步骤4)对不同类型的用户的消息使用不同的采集策略进行实时采集。 |
地址 |
100190 北京市海淀区中关村科学院南路6号 |