首页 ›存档› 技术 › 查看内容

Python实现基于SVM的股票预测

2018-3-30 13:00 |来自: 互联网 1777 0

摘要: 数据挖掘入门与实战公众号： datadw 核心因为是分类算法，因此不像ARIMA一样预测的是时序。分类就要有东西可分，因此将当日涨记为1，跌记为0，作为分类的依据。使用历史数据作为训练数据。处理数据：股票历 ...

数据挖掘入门与实战公众号： datadw

核心

因为是分类算法，因此不像ARIMA一样预测的是时序。分类就要有东西可分，因此将当日涨记为1，跌记为0，作为分类的依据。使用历史数据作为训练数据。

处理数据：

股票历史数据来源于yahoo_finance api，获取其中Open，Close，Low，High，Volume作为基础。因为除去Volume以外，其余数据都是Price，基于Price并不能很好的表达股票的特性，或者说并不太适用于SVM分类算法的特性。基于SVM算法的特性，股票并不是到达一个价格范围就有大概率涨或跌（不知道我这个表达大家能不能看懂）。

2.基于上述原因，我决定将Price转换成另一种形式的数据。例如：High-Low=全天最大价格差，Open-YesterdayOpen=当天Open价格变动，Open-YesterdayClose=开盘价格变动。（我也并不太懂经济学，仅仅是为了寻找另一种更好的方案）

3.单纯地基于历史数据是完全不够的，因此还使用了R语言和tm.plugin.sentiment包，进行语义分析，进行新闻正面负面的判定。这块不是我做的，了解的并不多。新闻并不是每天都有的，这样的话新闻数据就显得有些鸡肋，无法在分类算法中起到作用，但是我们能在多个站点中提取，或是直接将关键字定为Debt（判断大众反应）。

4.这里仅仅是进行了两个站点的新闻挖掘，然后可通过rpy2包在Python中运行R语言，或是R语言得到的数据导出成Json，Python再读取。至此，数据处理告一段落。