跳到正文
原文
Berkeley AI Research·· 2025-11-01AI 评分53

Transitive RL:一种不依赖 TD learning 的长时程强化学习方法

RL without TD learning

AI 导读

Berkeley AI Research 介绍了 Transitive RL(TRL),一种用分治方式进行价值学习、减少 TD learning 中误差累积的离线强化学习算法。

来源:Berkeley AI Research · bair.berkeley.edu