技术能力
四大核心方向,从模型架构到企业级落地
大模型架构与训练
模型架构解读、预训练与对齐技术,覆盖 Transformer 与 MoE 等主流体系。
Transformer MoE 注意力机制 长上下文 预训练对齐 多模态
推理与部署
vLLM / SGLang 推理框架部署调优,KV Cache 优化、量化与高并发服务化。
vLLM SGLang KV Cache 量化压缩 并行推理 服务化调优
Agent 工程化
从单 Agent 到 Multi-Agent 协作,MCP 协议统一工具接入与 Workflow 编排。
Agent 设计模式 MCP 协议 Workflow Multi-Agent 工具调用 RAG 检索
企业级 AI 落地
RAG 知识库与文档智能,AI PaaS 平台架构,GPU 集群与容器化运维。
RAG 知识库 文档智能 OCR 多模态 AI PaaS Docker Kubernetes
代表工程
我做过的真实工程项目,从架构设计到性能优化
精选文章
最能代表技术深度的代表作,建议从这些开始阅读
内容导航全部分类(36 个)
最新文章全部 237 篇
- DeepSeek-V4.1-Flash技术调研报告:CED编解码架构、CSA2跨层缓存压缩与KV Cache极致优化2026-09-11
- LM Studio部署Qwen3.8-27B实战(GB10):一键安装、GGUF模型加载与OpenAI兼容API服务2026-08-28
- MiniCPM-O 4.5 CookBook概览:多模态模型配套文档与使用指南入口2026-08-25
- Qwen3.6-27B与Qwen3.8-27B部署实战:vLLM Docker镜像、FP8量化与单卡推理2026-08-25
- 主机DNS解析排查记录:网络连通性与域名解析故障定位(20260723)2026-08-20
- H20部署DeepSeek-V4-Flash-0731实战:FP8 KV Cache、DSpark投机解码与专家并行调优2026-08-10
- 大模型推理加速三种草稿模型对比:DFlash纯并行、DSpark半自回归与Eagle3纯自回归架构选型2026-08-10
- PaddleOCR-VL部署遗留问题排查:容器报错、API文档与vLLM部署配置参考2026-07-30