推荐、模型与数据 · reproduction
cs285-deep-rl
基于加州大学伯克利分校 CS285 公开材料的深度强化学习自学作业,涵盖模仿学习、策略梯度、价值方法、模型式学习与离线强化学习。
CS
仓库appleweiping/cs285-deep-rl
状态active
Demo 证据none
最近更新2026-07-06
个人贡献
这项记录所呈现的工作
基于所列公开课程或资料的自学复现;上游教学材料的署名保留在仓库中。
技术与主题
当前暂无公开 Demo。
推荐、模型与数据 · reproduction
基于加州大学伯克利分校 CS285 公开材料的深度强化学习自学作业,涵盖模仿学习、策略梯度、价值方法、模型式学习与离线强化学习。
个人贡献
基于所列公开课程或资料的自学复现;上游教学材料的署名保留在仓库中。
技术与主题
当前暂无公开 Demo。