跳到正文
孔明の博客
AI 大模型研发与应用
Home
Archives
Search
输入搜索关键词
Great! 184 posts in total. Keep on posting.
2025
04-22
模型压缩三剑客:量化、蒸馏与剪枝的原理对比
04-22
手算 LLM 参数量:以 Qwen2.5-32B 为例逐层拆解
04-22
思维链与推理编排:从 CoT、自我一致性到 ToT 与 GoT
04-21
探秘 Transformer 之(24):KV Cache 优化的原理与方法分类
04-21
SnapKV 详解:基于注意力一致性的 KV Cache 稀疏化
04-21
FlashMLA 详解:面向 Hopper 架构的 MLA 高效解码内核
04-16
Prefix-Tuning 与 Prompt Tuning 详解:软提示类参数高效微调
04-15
GLU 与 SwiGLU 激活函数详解:从门控线性单元到大模型 FFN 标配
04-15
ALiBi 详解:用线性偏置实现长度外推的注意力机制
04-14
预训练优化器—神经网络优化器全景:从 SGD 到 Adam
04-14
神经网络优化器详解:从 SGD、Momentum 到 Adam 的优化算法演进
04-11
LoRA 详解:低秩适配的原理与代码实现
1
…
8
9
10
…
16
0
%