暂未播放
LLM 训练/推理 · 分布式系统 · RLHF
用 RL 和因果推断的方法,让大模型更聪明、更可靠。
LLM 训练实战
DeepSpeed / FSDP 源码剖析与分布式训练踩坑
RLHF 全流程
从 Reward Model 到 PPO 调参的完整实战
推理优化
vLLM / TensorRT-LLM 源码分析与量化实战
论文解读
顶会论文深度复现与批判性解读