跳到正文
孔明の博客

AI 大模型研发与应用


  • Home

  • Archives

  • Search

大模型训练与微调Category

04-16

Prefix-Tuning 与 Prompt Tuning 详解:软提示类参数高效微调

04-11

LoRA 详解:低秩适配的原理与代码实现

04-08

NCCL 详解:多 GPU 集合通信库与 PyTorch 集成

04-08

常用 NVIDIA 运维指令速查:互联拓扑、NUMA 与 NVLink 查询

04-07

人类对齐与强化学习—RLHF 全流程与 PPO 原理源码解读

03-18

NVIDIA GPU 架构演进详解:从 Pascal 到 Blackwell

01-09

高性能 GPU 服务器硬件拓扑与集群组网详解

01-09

GPU 通信技术详解:GPUDirect、NVLink、NVSwitch 与 RDMA

11-26

Qwen2.5-7B-Instruct LoRA 微调实战:从数据构建到权重推理

11-18

NVIDIA A100 GPU 服务器配置详解与三代显卡对比

06-02

人类对齐与强化学习—DPO 直接偏好优化原理详解

05-24

LLaMA-Factory 使用指南:从环境校验到自定义数据集微调

123
戈孔明

戈孔明

185 posts
50 categories
736 tags
GitHub E-Mail
我的平台
  • 个人博客
  • 知识库
© 2020 — 2026 戈孔明 | 531.6k 赣ICP备20004005号
0%