1B模型全链路实验计划:MacBook Air M4 本地实战
从SFT到DPO再到部署,用1B参数大模型在Apple Silicon上跑通LLM训练全流程
2026-07-08
|
3240 字
|
16 分钟
LLM推理优化与部署
量化、加速与生产环境部署
2024-10-27
|
2764 字
|
14 分钟
多模态大模型技术
从CLIP到GPT-4V的视觉语言理解
2024-10-20
|
878 字
|
4 分钟
LLM Agent开发指南
构建具有规划与工具调用能力的智能体
2024-10-13
|
3526 字
|
18 分钟
RAG检索增强生成实战
构建企业级知识问答系统
2024-10-06
|
4376 字
|
22 分钟
提示工程最佳实践
掌握Prompt设计的艺术与科学
2024-09-29
|
4737 字
|
24 分钟
高效微调技术:LoRA与PEFT
参数高效微调方法实战
2024-09-22
|
2908 字
|
15 分钟
R语言学习
123
2024-09-16
|
1892 字
|
9 分钟
LLM训练技术详解
预训练、SFT与RLHF全流程
2024-09-15
|
2942 字
|
15 分钟
多人博弈AI设计
三人以上博弈的策略与联盟
2024-09-03
|
3586 字
|
18 分钟
Profile Image of the Author
枫语
LLM 训练/推理 · 分布式系统 · RLHF
公告
LLM 训练/推理 · 分布式系统 · RLHF — 用 RL 的方法让大模型更聪明
音乐
封面

音乐

暂未播放

0:000:00
暂无歌词
分类
标签
站点统计
文章
33
分类
9
标签
15
总字数
75,837
运行时长
0
最后活动
0 天前
站点信息
构建平台
GitHub Actions
博客版本
v6.13.5
文章许可
CC BY-NC-SA 4.0

文章目录