>> 东方证券-因子选股系列之一百:DFQ-HIST,添加图信息的选股因子挖掘系统-240207
| 上传日期: |
2024/2/7 |
大小: |
1319KB |
| 格式: |
pdf 共30页 |
来源: |
东方证券 |
| 评级: |
-- |
作者: |
刘静涵,杨怡玲 |
| 下载权限: |
此报告为加密报告 |
|
|
研究结论 HIST模型(sHare Information for Stock Trend forecasting,基于图的可通过挖掘概念共享信息进行股票趋势预测),由中山大学和微软亚洲研究院合作在2022年1月发布于arXiv。 DFQ-HIST模型在原文模型基础上进行修改和优化,是一种新的股票趋势预测框架,能够充分挖掘股票预定义概念和隐藏概念中的动态共享信息:(1)刻画股票联动现象;(2)引入人工预定义概念,并且考虑到了预定义概念的不完备性和动态变化性;(3)引入隐藏概念,进一步挖掘股票关联信息;(4)应用注意力机制,将个股信息和概念信息进行融合;(5)加入股票时序特征编码模块,融合股票自身的历史时序特征信息;(6)使用双重残差学习结构,处理不同模块的信息。(7)相比其他常见图模型,HIST模型效果最好。 DFQ-HIST模型中有几个关键步骤,对提升模型效果都有帮助:(1)多输入:使用基础特征和alpha因子两类输入;(2)多标签:使用未来5日、10日、20日收益率多个标签;(3)时序特征提取:GRU模型效果最好;(4)融合图信息:添加图信息后可以显著提升多头表现;(5)预定义概念选取:使用公司行业及主营业务构成数据;(6)预定义概念修正:校正预定义概念的共享信息、挖掘缺失的股票概念以及减少不太重要概念的影响可以提升模型性能;(7)隐藏概念挖掘:模型可以挖掘出在预定义概念之外的股票关联;(5)双重残差结构:移除预定义概念模块、隐藏概念模块、移除个体信息模块,或取消残差结构都将降低模型性能。 合成因子绩效:在中证全指股票池中,HIST模型合成因子得分各项表现均明显最强。测试集(2020-2023年)上rankic达到17%,rankicir达到1.34(未年化),20分组多头年化超额收益29.31%,月均单边换手73%。分组单调性好。因子受行业市值风格的影响较小,因子中性化后表现依然很强,优于其他模型。随机种子对全市场训练的模型结果影响不大,5个路径下得到的因子值相关系数在90%左右。 沪深300指数增强组合:2020年以来年化信息比达到2.27,年化对冲收益11.55%,年化跟踪误差4.87%,单边年换手7.45倍。 中证500指数增强组合:2020年以来年化信息比达到2.09,年化对冲收益13.13%,年化跟踪误差6%,单边年换手9.67倍。 中证1000指数增强组合:HIST模型在中证1000指增组合中表现突出:(1)整体表现:2020年以来年化信息比达到3.6,年化对冲收益25.55%,年化跟踪误差6.39%,单边年换手10.06倍。(2)回撤情况:超额收益净值曲线走势平滑,未出现长时间失效。超额收益最大回撤仅为4.55%,出现在2023年4月,且回撤持续时间很短。(3)分年表现:2020-2023每年均取得正超额,2023年对冲收益20%。 风险提示 1.量化模型失效风险。 2.极端市场环境对模型的影响。
|
|