跳到正文
孔明の博客

AI 大模型研发与应用


  • Home

  • Archives

  • Search

大模型全栈知识Category

03-05

LLM 参数量、计算量与显存占用分析:从 Decoder-Only 结构出发

02-18

DeepSeek-V3 技术报告解读:FP8 训练、DualPipe 与 MoE 负载均衡

11-18

混合专家模型 MoE 详解:稀疏性、负载均衡与 Transformer 结合

11-11

Hunyuan-Large 模型解读:3890 亿参数的开源 MoE 与 KV 缓存压缩

06-06

FP16、BF16 与 FP32 精度详解:位结构、表示范围与 PyTorch 实测

06-06

快速下载 HuggingFace 模型的几种方式:从浏览器到 Hf_transfer

06-02

BGE-M3 检索模型与私有化部署:FastAPI 向量服务搭建

06-02

InternLM2 模型卡梳理:20 万字长上下文与全维度能力提升

06-02

旋转位置编码 RoPE 详解:从绝对位置编码到旋转变换

05-16

图解 BERT 与 ELMo:NLP 中的迁移学习与词嵌入演进

05-16

Transformer 机制—结构详解:位置编码、自注意力与残差归一化

05-13

DeepSeek-V2 模型梳理:236B 参数 MoE 的架构与部署

1…567
戈孔明

戈孔明

185 posts
50 categories
736 tags
GitHub E-Mail
我的平台
  • 个人博客
  • 知识库
© 2020 — 2026 戈孔明 | 531.6k 赣ICP备20004005号
0%