标签

共 227 个标签
MoE 多模态 强化学习 vLLM 模型部署 预训练 分布式训练 长上下文 KV Cache 智能体 文档解析 论文解读 词嵌入 稀疏注意力 通义千问 注意力机制 推理优化 Transformer 图像分类 混合精度 RoPE 位置编码 卷积神经网络 DeepSeek Docker 模型架构 后训练 蒸馏 微调 RLHF 量化 RAG 推理加速 MLA 显存优化 文本分类 线性注意力 奖励模型 推理框架 多智能体 工具调用 向量检索 智谱AI PyTorch PPO 模型压缩 NVLink Git C++ 混合架构 上海AI实验室 大语言模型 美团 小米 MinerU 数据并行 流水线并行 分词 FP8 负载均衡 ZeRO 视觉语言模型 GoogLeNet Moonshot AI Decode 推理模型 全模态 GPU服务器 Nemotron 3 NVIDIA Qwen3.5 动态分辨率 Qwen3 字节跳动 张量并行 ReAct AutoGen LangGraph 框架选型 BGE-M3 sentence-transformers 重排序 中英双语 评测数据集 直线裁剪 FlashMLA DualPipe DeepSeek-OCR DeepSeek-V4 采样 GPU架构 投机解码 SwiGLU FFN NVSwitch 环境安装 Word2vec HuggingFace 腾讯混元 Muon Model Card 参数量 Prefix Caching Prefill LoRA PEFT 编程 LaTeX OmniDocBench 长思维链 PaddleOCR-VL PagedAttention Qwen-VL Qwen2.5-VL Qwen2.5 Qwen3-VL 序列并行 TextCNN RNN 迁移学习 dots.ocr 提示工程 综述 GitHubPages 自动并行 NER 优化器 ALiBi 线性偏置 AWQ 记忆机制 私有化部署 AlexNet Baichuan-7B DeepEP DeepGEMM EPLB 3FS DES Lightning Indexer On-Policy Distillation Elasticsearch BM25 TF-IDF 相关性排序 倒排索引 搜索引擎 DeepSpeed FastText FlashAttention FlashInfer FCN 解码内核 GRPO MuonSplit 专家迭代 Gemma 3 GPTQ Gemma 4 Glyph 字形渲染 GloVe Hill密码 自适应CoT Inkling InternLM2 大海捞针 QK-Clip Zero-Vision SFT FasterTransformer LLaMA-Factory N-gram Embedding ASIC Llama-1 RMSNorm DORA MCP Markdown MiniCPM-o 端侧模型 MiniMax-M1 MiniMax-M2 Switch-Transformer NCCL NNLM Mixtral Nex-N2 Nex-AGI NiN Phi-4-reasoning Qwen2.5-Omni Qwen2-VL DeepStack ResNet Qwen3.5-Omni ARIA SeedViT Sierpinski SnapKV Text-RCNN TextRNN Text-GCN GPT-2 VGG 上下文工程 TGI CTranslate2 Ray Serve DPO 图床 图神经网络 BERT DeepSeek-R1 Chain of Thought Self-Consistency Tree of Thoughts Graph of Thoughts 降低幻觉 球体细分 热传导方程 扫描转换 GLM-4.5V MiniCPM-V Ovis2.5 模型盘点 HMM Hexo