论文: https://xuehongyan.oss-cn-beijing.aliyuncs.com/kdd23_alpha_mining.pdf
github:https://github.com/RL-MLDM/alphagen
大概是将因子表达式用逆波兰表示,然后将找因子变成一个找seque的问题,通过定义各种简单算子为单个动作,进行强化学习建模。方法是ppo截断。
看方法论部分应该挺好理解,代码工程量比较大,数据接口和数据处理部分比较复杂,所以决定不如直接重写,数据用蔷薇自己的。
简易版autogen大致思路:
1. data_api.py
2. env.py: 继承gym库,如果有的话,
3. ppo方法,如果有stable-baselines3的ppo就用它,没有就自己写一个ppo,(ppo截断)
4. 算子实现:这个可以直接抄autogen的
5. train.py:直接抄自己以前代码
在期货市场,尤其是大宗上因为动量存在,可以试试海龟交易法, 参考:https://www.myquant.cn/docs/python_strategyies/110
做日频的,先在聚宽上进行回测,可以盈利后可以实盘手动调仓实现,顺便练交易纪律。
目前已经重现了逆波兰表达式的生成和解析,以及环境的框架。
它的四个policynet写的是比较规范的,可以学一下。 正余弦位置编码, 一种绝对位置编码方法。