跳到正文
戈孔明

大模型工程实践者 · 推理优化与 Agent 落地


  • 首页

  • 归档

  • 导航

  • 技术地图

  • 技术实践

  • 关于

  • 搜索
非常好! 共计 184 篇文章。 继续努力!

2026

08-04

Kimi-K3 技术报告解读:2.8T 参数的混合线性注意力架构

08-04

Kimi-K2 技术报告解读:MuonClip 优化器与智能体能力训练

08-04

Kimi-K2.5 技术报告解读:视觉智能体与 Zero-Vision SFT

08-04

InternVL3 技术报告解读:原生多模态预训练与测试时配方

08-04

InternVL3.5 技术报告解读:Cascade RL 与动态视觉分辨率路由

08-04

Inkling 技术报告解读:Thinking Machines Lab 的 975B 开源 MoE 模型

08-04

Hunyuan-TurboS 技术报告解读:Mamba-Transformer 协同与自适应长短思维链

08-04

GLM-5 技术报告解读:从 Vibe Coding 到智能体工程

08-04

GLM-5.2 技术报告解读:IndexShare 稀疏注意力与反奖励作弊强化学习

08-04

GLM-4.5 技术报告解读:Agentic、推理与编码三位一体的基座模型

08-04

Gemma 4 技术报告解读:P-RoPE 与键值复用的极简长上下文设计

08-04

Gemma 3 技术报告解读:局部全局交替注意力与全系列知识蒸馏

1234…16
戈孔明

戈孔明

戈孔明,大模型工程实践者。专注大模型推理优化、AI Agent、RAG 与企业级 AI 应用落地,沉淀 180+ 篇原创技术文章与工程实践笔记。

184 文章
47 分类
227 标签
GitHub E-Mail
近期文章
  • DeepSeek-V3.2 技术报告解读:稀疏注意力与专家蒸馏
  • 开源大模型技术演进时间线:预训练、后训练与强化学习
  • Seed2.0 Model Card 解读:面向真实世界复杂性的三档模型
  • Seed1.5-VL 技术报告解读:原生分辨率视觉与混合可验证奖励强化学习
  • Seed1.5-Thinking 技术报告解读:VAPO 与 DAPO 强化学习训练推理模型
热门标签
  • MoE
  • 多模态
  • 强化学习
  • vLLM
  • 模型部署
  • 预训练
  • 分布式训练
  • 长上下文
  • KV Cache
  • 智能体
  • 文档解析
  • 词嵌入
  • 论文解读
  • 稀疏注意力
  • 通义千问
  • 注意力机制
  • 推理优化
  • Transformer
  • 图像分类
  • 混合精度
© 2020 — 2026 戈孔明 | 544.6k 赣ICP备20004005号
0%