跳到正文
孔明の博客

AI 大模型研发与应用


  • Home

  • Archives

  • Search
Great! 184 posts in total. Keep on posting.

2025

04-22

模型压缩三剑客:量化、蒸馏与剪枝的原理对比

04-22

手算 LLM 参数量:以 Qwen2.5-32B 为例逐层拆解

04-22

思维链与推理编排:从 CoT、自我一致性到 ToT 与 GoT

04-21

探秘 Transformer 之(24):KV Cache 优化的原理与方法分类

04-21

SnapKV 详解:基于注意力一致性的 KV Cache 稀疏化

04-21

FlashMLA 详解:面向 Hopper 架构的 MLA 高效解码内核

04-16

Prefix-Tuning 与 Prompt Tuning 详解:软提示类参数高效微调

04-15

GLU 与 SwiGLU 激活函数详解:从门控线性单元到大模型 FFN 标配

04-15

ALiBi 详解:用线性偏置实现长度外推的注意力机制

04-14

预训练优化器—神经网络优化器全景:从 SGD 到 Adam

04-14

神经网络优化器详解:从 SGD、Momentum 到 Adam 的优化算法演进

04-11

LoRA 详解:低秩适配的原理与代码实现

1…8910…16
戈孔明

戈孔明

184 posts
49 categories
735 tags
GitHub E-Mail
我的平台
  • 个人博客
  • 知识库
© 2020 — 2026 戈孔明 | 544.6k 赣ICP备20004005号
0%