跳到正文
孔明の博客
AI 大模型研发与应用
Home
Archives
Search
输入搜索关键词
大模型训练与微调
Category
08-15
人类对齐与强化学习—On-Policy 与 Off-Policy 深度辨析
07-22
主流大模型评测数据集速查:从 AIME、GPQA 到 MMLU
04-28
MoE 并行详解:专家拆分与分布式并行策略
04-28
分布式训练并行策略总览:从数据并行到自动并行
04-28
人类对齐与强化学习—RLHF 核心问题梳理与实践难点
04-27
自动并行详解:从 Mesh-TensorFlow 到 GSPMD
04-27
多维混合并行详解:DP、PP、TP 的组合与业界实践
04-25
流水线并行详解:微批次切分与 GPipe 实现原理
04-25
张量并行详解:层内切分的行并行与列并行
04-25
序列并行详解:突破长序列训练的显存瓶颈
04-23
分布式训练概述:八类并行技术的全景图
04-23
数据并行详解:从 PyTorch DP、DDP 到 FSDP 与 ZeRO
1
2
3
0
%