跳到正文
戈孔明

大模型工程实践者 · 推理优化与 Agent 落地


  • 首页

  • 归档

  • 导航

  • 技术地图

  • 技术实践

  • 关于

  • 搜索
非常好! 共计 184 篇文章。 继续努力!

2026

08-04

Nex-N2 技术报告摘要:面向智能体的 Agentic Thinking 框架

08-04

NVIDIA Nemotron 3 白皮书解读:混合 Mamba-Transformer MoE 家族

08-04

Nemotron 3 Ultra 技术报告解读:550B 规模的 NVFP4 预训练与多教师蒸馏

08-04

Nemotron 3 Super 技术报告解读:LatentMoE 与 NVFP4 预训练

08-04

MiniMax-M2 技术报告解读:细粒度专家与 Sigmoid 门控 MoE

08-04

MiniMax-M1 技术报告解读:Lightning Attention 与高效测试时扩展

08-04

MiMo-VL 技术报告解读:混合在线强化学习的多模态推理模型

08-04

MiMo-V2-Flash 技术报告解读:混合滑窗注意力与多教师在线蒸馏

08-04

MiMo-7B 技术报告解读:为推理能力而生的预训练与后训练

08-04

LongCat-Flash 技术报告解读:零计算专家与 Shortcut 连接 MoE

08-04

LongCat-Flash-Thinking 技术报告解读:领域并行强化学习与 DORA 异步框架

08-04

LongCat-2.0 技术报告解读:稀疏注意力与 N-Gram 嵌入扩参

123…16
戈孔明

戈孔明

戈孔明,大模型工程实践者。专注大模型推理优化、AI Agent、RAG 与企业级 AI 应用落地,沉淀 180+ 篇原创技术文章与工程实践笔记。

184 文章
47 分类
227 标签
GitHub E-Mail
近期文章
  • DeepSeek-V3.2 技术报告解读:稀疏注意力与专家蒸馏
  • 开源大模型技术演进时间线:预训练、后训练与强化学习
  • Seed2.0 Model Card 解读:面向真实世界复杂性的三档模型
  • Seed1.5-VL 技术报告解读:原生分辨率视觉与混合可验证奖励强化学习
  • Seed1.5-Thinking 技术报告解读:VAPO 与 DAPO 强化学习训练推理模型
热门标签
  • MoE
  • 多模态
  • 强化学习
  • vLLM
  • 模型部署
  • 预训练
  • 分布式训练
  • 长上下文
  • KV Cache
  • 智能体
  • 文档解析
  • 词嵌入
  • 稀疏注意力
  • 论文解读
  • 通义千问
  • 注意力机制
  • 推理优化
  • Transformer
  • 混合精度
  • RoPE
© 2020 — 2026 戈孔明 | 544.6k 赣ICP备20004005号
0%