跳到正文
孔明の博客
AI 大模型研发与应用
Home
Archives
Search
输入搜索关键词
大模型训练与微调
Category
04-16
Prefix-Tuning 与 Prompt Tuning 详解:软提示类参数高效微调
04-11
LoRA 详解:低秩适配的原理与代码实现
04-08
NCCL 详解:多 GPU 集合通信库与 PyTorch 集成
04-08
常用 NVIDIA 运维指令速查:互联拓扑、NUMA 与 NVLink 查询
04-07
人类对齐与强化学习—RLHF 全流程与 PPO 原理源码解读
03-18
NVIDIA GPU 架构演进详解:从 Pascal 到 Blackwell
01-09
高性能 GPU 服务器硬件拓扑与集群组网详解
01-09
GPU 通信技术详解:GPUDirect、NVLink、NVSwitch 与 RDMA
11-26
Qwen2.5-7B-Instruct LoRA 微调实战:从数据构建到权重推理
11-18
NVIDIA A100 GPU 服务器配置详解与三代显卡对比
06-02
人类对齐与强化学习—DPO 直接偏好优化原理详解
05-24
LLaMA-Factory 使用指南:从环境校验到自定义数据集微调
1
2
3
0
%