返回
网页爬虫与文本挖掘把非结构化网页变成可回测信号。本文从合规红线讲起,用 Python 演示 requests+BeautifulSoup 采集、jieba 分词、情感打分构建日度情绪指数,再到 TF-IDF 与领先-滞后检验,并指出前视偏差等陷阱。
量化交易
另类数据
文本挖掘
网络爬虫
python