跳到正文
戈孔明
大模型工程实践者 · 推理优化与 Agent 落地
首页
归档
导航
技术地图
技术实践
关于
搜索
输入搜索关键词
Qwen
标签
08-28
LM Studio部署Qwen3.8-27B实战(GB10):一键安装、GGUF模型加载与OpenAI兼容API服务
08-25
Qwen3.6-27B与Qwen3.8-27B部署实战:vLLM Docker镜像、FP8量化与单卡推理
07-23
vLLM 推理框架部署 Qwen3-235B-A22B 大语言模型实践
06-16
A100八卡部署Qwen3.5-122B-A10B实战:Docker与裸机vLLM启动、FP8优化与Benchmark
06-10
Qwen3.5 与 Qwen3 深度架构对比:混合 SSM-Transformer 的效率革命
06-04
Mooncake推理框架环境搭建实战:系统依赖、编译安装与Qwen2.5-72B-Instruct部署
06-04
Mooncake推理框架Qwen2.5-72B性能报告:预填充解码分离、RDMA/TCP后端与多QPS延迟实测
06-04
Ollama部署Qwen2-7B-Instruct实战:本地大模型工具、自定义GGUF文件运行与API调用
06-04
Transformers部署Qwen-14B-Chat实战:环境安装、OpenAI兼容API服务启动与Function Call测试
06-04
最新开源大模型简介(第38周):Qwen3-Max、GLM-5.2等模型发布动态与能力亮点
05-29
2026年5月主流开源大模型横向对比:DeepSeek-V4、GLM-5.1、Kimi K2.6与Qwen3.5架构能力及vLLM部署
10-22
vLLM 0.11.0部署Qwen3-VL-2B-Instruct实战:Docker启动、OpenAI兼容API调用与返回参数解析
1
2
3
0
%