跳到正文
孔明の博客

AI 大模型研发与应用


  • Home

  • Archives

  • Search
Great! 185 posts in total. Keep on posting.

2024

05-16

Transformer 机制—结构详解:位置编码、自注意力与残差归一化

05-13

DeepSeek-V2 模型梳理:236B 参数 MoE 的架构与部署

04-25

Mixtral 8x7B 详解:稀疏专家混合模型的架构与源码分析

04-24

vLLM 源码解析(一):SequenceGroup 与调度执行链路

04-23

vLLM 架构解析:离线批处理、在线服务与 LLMEngine 内核

04-23

Text2vec-Large-Chinese 私有化部署:中文句向量服务搭建

04-22

Baichuan-7B 与 Baichuan-13B 梳理:开源可商用中英双语模型

04-22

vLLM Prefix 前缀缓存详解:复用 System Prompt 的计算

04-22

PagedAttention 详解:用虚拟内存思想管理 KV Cache

04-22

Continuous Batching 详解:动态批处理提升 GPU 利用率

04-19

Llama-1 与 Llama-2 模型梳理:架构改动与训练数据

04-19

ChatGLM-6B 与 ChatGLM2-6B 梳理:中英双语对话模型与本地部署

1…121314…16
戈孔明

戈孔明

185 posts
50 categories
736 tags
GitHub E-Mail
我的平台
  • 个人博客
  • 知识库
© 2020 — 2026 戈孔明 | 531.7k 赣ICP备20004005号
0%