Tag: module-m7
-
【AI 核心深度 M7-081】解释在线实验评估多目标的难点(Explain the Methodological Challenges and Frameworks for Multi-Objective Online A/B Testing)深度数理推导与工程落地解析
多目标实验的’胜出’定义模糊(A 在某目标好、B 在另一目标好);需’主指标 + 护栏’框架、帕累托比较与多重比较校正。
-
【AI 核心深度 M7-082】解释长期价值建模(LTV)与短期指标的权衡(Explain Customer Lifetime Value (LTV) Modeling versus Short-Term Metric Trade-Offs)深度数理推导与工程落地解析
LTV 关注用户长期价值;短期指标(CTR)与 LTV 可能冲突;用’代理指标’、’长期实验’与’约束短期’来建模。
-
【AI 核心深度 M7-083】解释离线评估为何不能直接用历史数据评估新策略(Explain Why Offline Evaluation Cannot Naively Use Historical Logged Data to Evaluate New Policies)深度数理推导与工程落地解析
历史数据由’旧策略’产生(有偏),故’新策略在历史数据上的表现’不等于’新策略上线后的表现’。
-
【AI 核心深度 M7-084】写出 IPS 估计式并解释其方差问题(Write the Inverse Propensity Scoring (IPS) Estimator and Explain Its High Variance and Mitigation Strategies)深度数理推导与工程落地解析
IPS 用’1/倾向’加权历史奖励,得到无偏估计;但倾向很小时权重爆炸 → 方差极大(需截断/自归一化)。
-
【AI 核心深度 M7-085】解释 Doubly Robust 估计与它的双重稳健性(Explain the Doubly Robust (DR) Estimator and Its Dual Robustness Property in Off-Policy Evaluation)深度数理推导与工程落地解析
DR = 直接方法(模型预测)+ IPS 修正;模型或倾向之一正确即可无偏(双重稳健),且方差通常更低。
-
【AI 核心深度 M7-086】解释 OPE 中的权重截断与自归一化(Explain Importance Weight Clipping and Self-Normalization (SNIPS) in Off-Policy Evaluation)深度数理推导与工程落地解析
权重截断把 w 限制在 [0,M](降方差、引入偏差);自归一化用 Σw 归一(有界、对缩放不敏感)。
-
【AI 核心深度 M7-087】解释离线评估与在线 A/B 的相关性验证(Explain the Methodological Verification of Correlation Between Offline OPE Metrics and Online A/B Results)深度数理推导与工程落地解析
OPE/离线指标需与’在线 A/B 结果’相关才有意义;用历史 A/B 数据验证相关性(相关系数、排序一致性)。
-
【AI 核心深度 M7-088】解释 OPE 的适用条件与失败模式(Explain Core Assumptions, Failure Modes, and Violation Diagnostics in Off-Policy Evaluation)深度数理推导与工程落地解析
OPE 需三大假设(无混淆/正性/SUTVA);常见失败:正性违反(新策略选新物品)、混淆、干扰、非平稳。
-
【AI 核心深度 M7-068】解释长尾商品/查询的检索困难与解法(Explain the Challenges of Long-Tail Items and Queries in Search/Recommendation and Their Solutions)深度数理推导与工程落地解析
长尾的交互少(嵌入训练不足)且语义模糊(稀疏检索也难);用内容特征、混合检索、查询改写、跨域迁移。
-
【AI 核心深度 M7-069】解释位置偏置与冷启动的交互(Explain the Destructive Interaction Between Position Bias and Cold-Start in Recommendation)深度数理推导与工程落地解析
冷启动物品排在后面 → 无曝光 → 无数据(位置偏置加剧冷启动);需给新物品’靠前位置’的探索配额。