跳到正文
孔明の博客

AI 大模型研发与应用


  • Home

  • Archives

  • Search

TransformerTag

09-08

LLM 领域重要论文清单:从 Transformer 到前沿探索

05-07

探秘 Transformer 之(2):总体架构与文本生成执行流程

04-25

探秘 Transformer 之(1):注意力机制的背景与演化动机

04-22

手算 LLM 参数量:以 Qwen2.5-32B 为例逐层拆解

04-21

探秘 Transformer 之(24):KV Cache 优化的原理与方法分类

03-13

大语言模型简史:从 Transformer (2017) 到 DeepSeek-R1 (2025)

06-02

旋转位置编码 RoPE 详解:从绝对位置编码到旋转变换

05-16

Transformer 机制—结构详解:位置编码、自注意力与残差归一化

戈孔明

戈孔明

185 posts
50 categories
736 tags
GitHub E-Mail
我的平台
  • 个人博客
  • 知识库
© 2020 — 2026 戈孔明 | 531.6k 赣ICP备20004005号
0%