标签
共 227 个标签MoE 多模态 强化学习 vLLM 模型部署 预训练 分布式训练 长上下文 KV Cache 智能体 文档解析 词嵌入 论文解读 稀疏注意力 通义千问 注意力机制 推理优化 Transformer 图像分类 混合精度 RoPE 位置编码 卷积神经网络 DeepSeek Docker 模型架构 后训练 蒸馏 微调 RLHF 量化 RAG 推理加速 MLA 显存优化 文本分类 线性注意力 奖励模型 推理框架 多智能体 工具调用 向量检索 智谱AI PyTorch 模型压缩 PPO NVLink Git C++ 混合架构 上海AI实验室 大语言模型 美团 小米 MinerU 数据并行 流水线并行 分词 FP8 负载均衡 ZeRO 视觉语言模型 GoogLeNet Moonshot AI Decode 推理模型 全模态 GPU服务器 Nemotron 3 NVIDIA Qwen3.5 动态分辨率 Qwen3 字节跳动 张量并行 ReAct AutoGen LangGraph 框架选型 BGE-M3 sentence-transformers 重排序 直线裁剪 中英双语 FlashMLA DualPipe DeepSeek-OCR 评测数据集 DeepSeek-V4 采样 GPU架构 SwiGLU FFN 投机解码 NVSwitch 环境安装 Word2vec HuggingFace Model Card 腾讯混元 Muon Prefix Caching 参数量 Prefill LoRA PEFT 编程 LaTeX 长思维链 OmniDocBench PaddleOCR-VL PagedAttention Qwen-VL Qwen2.5-VL Qwen2.5 Qwen3-VL 序列并行 TextCNN RNN 迁移学习 dots.ocr 提示工程 综述 GitHubPages 自动并行 NER 优化器 AWQ ALiBi 线性偏置 记忆机制 私有化部署 AlexNet DES DeepEP DeepGEMM EPLB 3FS Baichuan-7B On-Policy Distillation Lightning Indexer Elasticsearch BM25 TF-IDF 相关性排序 倒排索引 搜索引擎 DeepSpeed FastText FlashAttention FlashInfer FCN 解码内核 专家迭代 GPTQ GRPO MuonSplit Gemma 3 GloVe Glyph 字形渲染 Hill密码 Gemma 4 InternLM2 大海捞针 自适应CoT Inkling QK-Clip Zero-Vision SFT FasterTransformer LLaMA-Factory Llama-1 RMSNorm N-gram Embedding ASIC MCP DORA Markdown MiniCPM-o 端侧模型 MiniMax-M1 MiniMax-M2 NNLM Mixtral NCCL Switch-Transformer Nex-N2 Nex-AGI NiN Qwen2-VL Qwen2.5-Omni DeepStack Phi-4-reasoning Qwen3.5-Omni ARIA SeedViT ResNet Sierpinski Text-RCNN Text-GCN TextRNN SnapKV GPT-2 VGG 上下文工程 TGI CTranslate2 Ray Serve DPO 图床 图神经网络 BERT DeepSeek-R1 Chain of Thought Self-Consistency Tree of Thoughts Graph of Thoughts 降低幻觉 球体细分 热传导方程 扫描转换 GLM-4.5V MiniCPM-V Ovis2.5 模型盘点 HMM Hexo