arXiv 机器学习· Bicheng Wang, Xinyi Zhang·· 2 天前AI 评分29
深度强化学习股票交易:结合前向重训练的 Actor-Critic 方法基准评测
Deep Reinforcement Learning for Equity Trading: Benchmarking Actor-Critic Methods with Forward Retraining
AI 导读
一项基准研究评测了 A2C、PPO、DDPG、TD3 和 SAC 五种深度强化学习 Actor-Critic 方法在标普 500 股票交易中的表现。DDPG 取得最高的 55.5% 年化收益率与 1.38 夏普比率,TD3 和 SAC 则以 1.37 与 1.33 的夏普比率及约 25% 最大回撤实现更优风险收益平衡。
来源:arXiv 机器学习 · arxiv.org