深度Q网络案例实践
从理论到代码:完整实现DQN算法解决CartPole问题
2024-06-30
|
2132 字
|
11 分钟
关于数据分析的一些思考
数据科学方法论与实践框架构建
2024-06-09
|
12102 字
|
61 分钟
强化学习笔记记录
从基础概念到算法实现的完整学习路径
2024-06-09
|
1351 字
|
7 分钟
Profile Image of the Author
枫语
LLM 训练/推理 · 分布式系统 · RLHF
公告
LLM 训练/推理 · 分布式系统 · RLHF — 用 RL 的方法让大模型更聪明
音乐
封面

音乐

暂未播放

0:000:00
暂无歌词
分类
标签
站点统计
文章
33
分类
9
标签
15
总字数
75,837
运行时长
0
最后活动
0 天前
站点信息
构建平台
GitHub Actions
博客版本
v6.13.5
文章许可
CC BY-NC-SA 4.0

文章目录