Tag: module-m4
-
【AI 核心深度 M4-087】解释 GNN 的消息传递框架。(Message Passing Neural Network (MPNN) Framework in GNNs)深度数理推导与工程落地解析
每层分三步:邻居发消息(message)、聚合(aggregate,置换不变)、更新自身(update);堆叠 L 层即聚合 L 跳邻域。
-
【AI 核心深度 M4-088】比较 GCN、GraphSAGE 与 GAT。(Comparison of Graph Convolutional Networks: GCN, GraphSAGE, and GAT)深度数理推导与工程落地解析
GCN 用归一化的固定权重平均;GraphSAGE 采样邻居并学习聚合(可归纳);GAT 用注意力学习邻居权重。
-
【AI 核心深度 M4-089】解释 GNN 的过平滑与过挤压问题。(Oversmoothing and Oversquashing in Deep GNNs)深度数理推导与工程落地解析
过平滑:层数增加使节点表示趋同;过挤压:远距离信息需挤过瓶颈节点,导致长程依赖丢失。
-
【AI 核心深度 M4-090】解释 GNN 在大规模图上的训练策略。(Large-Scale Graph Training Strategies: Node Sampling, Layer Sampling, and Subgraph Partitioning)深度数理推导与工程落地解析
邻居采样(GraphSAGE/邻居爆炸)、子图采样(Cluster-GCN)、以及分布式训练与图分区。
-
【AI 核心深度 M4-091】解释异构图与关系图卷积(R-GCN)。(Heterogeneous Graphs and Relational Graph Convolutional Networks (R-GCN))深度数理推导与工程落地解析
异构图有多种节点/边类型;R-GCN 为每种关系用独立权重矩阵,参数随关系数增长,用基分解/块对角降参。
-
【AI 核心深度 M4-063】解释 chunked prefill 与混合批处理调度。(Chunked Prefill and Piggyback Hybrid Batch Scheduling)深度数理推导与工程落地解析
把长 prompt 的 prefill 切成小块,与 decode 请求混在同一批中,兼顾 TTFT 与吞吐(算力与带宽互补)。
-
【AI 核心深度 M4-064】解释投机解码的变体(Medusa / EAGLE / MTP)。(Speculative Decoding Variants: Medusa, EAGLE, and Multi-Token Prediction)深度数理推导与工程落地解析
Medusa 加多个预测头一次预测多 token;EAGLE 在特征层自回归预测;MTP 在训练时加多 token 预测目标。
-
【AI 核心深度 M4-065】解释推理的吞吐-延迟权衡(TTFT / TPOT / 批大小)。(Throughput vs. Latency Trade-offs in Inference: TTFT, TPOT, and Batch Size)深度数理推导与工程落地解析
增大 batch 提升吞吐但增加单请求延迟(TTFT/TPOT);服务需在 SLO 约束下最大化吞吐。
-
【AI 核心深度 M4-066】解释 PD 分离(prefill-decode disaggregation)。(Prefill-Decode Disaggregation Architecture)深度数理推导与工程落地解析
把 prefill 与 decode 部署在不同实例(各自优化),通过高速网络传 KV cache;消除两阶段互相干扰。
-
【AI 核心深度 M4-067】解释长上下文的主要挑战。(Core Challenges of Scaling to Long Context Windows)深度数理推导与工程落地解析
注意力 O(L²) 计算与 KV cache O(L) 显存、位置编码外推、训练数据稀缺、以及’有效利用’(lost in the middle)四类挑战。