Reddit · r/MachineLearning· /u/microscope1024·· 11 天前AI 评分42
如何用强化学习训练神经网络玩街头霸王风格的游戏
Teaching Neural Nets to Fight with RL [P]
AI 导读
作者用强化学习训练两个智能体玩类似街头霸王的游戏,发现智能体非常擅长奖励黑客行为。通过引入联盟学习,智能体学会更通用的策略,而非仅针对特定对手。实验展示了强化学习训练中奖励设计的挑战与解决方案。
来源:Reddit · r/MachineLearning · reddit.com