跳到正文
孔明の博客

AI 大模型研发与应用


  • Home

  • Archives

  • Search

大模型训练与微调Category

08-15

人类对齐与强化学习—On-Policy 与 Off-Policy 深度辨析

07-22

主流大模型评测数据集速查:从 AIME、GPQA 到 MMLU

04-28

MoE 并行详解:专家拆分与分布式并行策略

04-28

分布式训练并行策略总览:从数据并行到自动并行

04-28

人类对齐与强化学习—RLHF 核心问题梳理与实践难点

04-27

自动并行详解:从 Mesh-TensorFlow 到 GSPMD

04-27

多维混合并行详解:DP、PP、TP 的组合与业界实践

04-25

流水线并行详解:微批次切分与 GPipe 实现原理

04-25

张量并行详解:层内切分的行并行与列并行

04-25

序列并行详解:突破长序列训练的显存瓶颈

04-23

分布式训练概述:八类并行技术的全景图

04-23

数据并行详解:从 PyTorch DP、DDP 到 FSDP 与 ZeRO

123
戈孔明

戈孔明

185 posts
50 categories
736 tags
GitHub E-Mail
我的平台
  • 个人博客
  • 知识库
© 2020 — 2026 戈孔明 | 531.6k 赣ICP备20004005号
0%