推荐、模型与数据 · reproduction

cs285-deep-rl

基于加州大学伯克利分校 CS285 公开材料的深度强化学习自学作业,涵盖模仿学习、策略梯度、价值方法、模型式学习与离线强化学习。

CS
仓库appleweiping/cs285-deep-rl
状态active
Demo 证据none
最近更新2026-07-06

个人贡献

这项记录所呈现的工作

基于所列公开课程或资料的自学复现;上游教学材料的署名保留在仓库中。

技术与主题

Jupyter NotebookPythonTeXShellAwkactor-criticcs285csdiydeep-rlpolicy-gradientq-learningreinforcement-learning

当前暂无公开 Demo。