跳到正文
孔明の博客

AI 大模型研发与应用


  • Home

  • Archives

  • Search

模型认知与生态Category

08-04

DeepSeek-V3.2 技术报告解读:稀疏注意力与专家蒸馏

08-04

开源大模型技术演进时间线:预训练、后训练与强化学习

08-04

Seed2.0 Model Card 解读:面向真实世界复杂性的三档模型

08-04

Seed1.5-VL 技术报告解读:原生分辨率视觉与混合可验证奖励强化学习

08-04

Seed1.5-Thinking 技术报告解读:VAPO 与 DAPO 强化学习训练推理模型

08-04

Qwen3 技术报告解读:三阶段预训练与思考模式统一

08-04

Qwen3.5 技术报告解读:397B 稀疏 MoE 与原生多模态融合

08-04

Qwen3.5-Omni 技术报告解读:ARIA 单流生成与在线策略蒸馏

08-04

Qwen3-VL 技术报告解读:交错 MRoPE 与 DeepStack 视觉特征融合

08-04

Qwen2.5-VL 技术报告解读:原生动态分辨率 ViT 与绝对时间编码

08-04

Qwen2.5-Omni 技术报告解读:时间对齐多模态 RoPE 与流式语音生成

08-04

Phi-4-Reasoning 技术报告解读:可教学数据过滤与推理能力训练

12…5
戈孔明

戈孔明

185 posts
50 categories
736 tags
GitHub E-Mail
我的平台
  • 个人博客
  • 知识库
© 2020 — 2026 戈孔明 | 531.6k 赣ICP备20004005号
0%