跳至主要內容
Kinger 的技术博客
主页
博文
AI 基础设施
AI 大模型
计算机网络
面试
运维
云原生
开发
AIOps 平台
数据库
杂项笔记
全部分类
AI 助手
CSDN
Post_training(后训练)
Kinger
2026/7/23
小于 1 分钟
AI基础设施
Post training(后训练)
待补充
子文档
SFT(监督微调)
RL(Reinforcement_Learning,_强化学习)
IL(Imitation_Learning,模仿学习)
上一页
IL( Imitation Learning,模仿学习)
下一页
RL( Reinforcement Learning, 强化学习)