Category: AI & 机器学习 (AI & Machine Learning)
-
MLOps 与在线测试全景:Data Drift 监控、PSI 指标、A/B 测试与 CUPED 方差降低
> **核心摘要**:模型部署上线绝非终点,真实世界数据分布随着时间不断演化。**MLOps & LLMOps** 建立了模型监控、自动化重训练与科学在线实验闭环。通过 **PSI (Population Stability Index)** 实时预警数据漂移 (Data Drift),利用 **CUPED** 算法降
-
归一化与正则化全景:BatchNorm、LayerNorm、RMSNorm、L0/L1/L2 权重衰减与 Inverted Dropout 极客指南
> **核心摘要**:在深度神经网络的训练过程中,**归一化 (Normalization)** 与 **正则化 (Regularization)** 是平滑 Loss 优化曲面、消除内部协变量偏移 (Internal Covariate Shift, ICS) 以及防御过拟合 (Overfitting) 的两大核心工
-
高效微调 (PEFT) 架构全景:LoRA、QLoRA、DoRA、Prefix/Prompt Tuning、Adapters 与 MoRA/ReLoRA 深度剖析
> **核心摘要**:随着大语言模型 (LLM) 参数量迈向千亿级,全参数微调 (Full Fine-Tuning) 的显存与计算开销变得不可承受。**高效参数微调 (Parameter-Efficient Fine-Tuning, PEFT)** 技术通过仅冻结预训练基座权重 $W_0$,仅训练极少量的增量参数(通常
-
机器学习评估指标与数据工程全景:分类/回归/排序(NDCG)、概率校准、不平衡采样与文本预处理极客指南
> **核心摘要**:评估指标与数据预处理是连接模型输出与真实业务价值的数理基石。本指南全量整合 “ 中 9 大模块,涵盖分类评估(混淆矩阵、F-beta、Macro/Micro-F1、Hamming Loss)、搜索推荐排序评估(MRR、MAP、DCG/NDCG)、回归评估(MSE、RMSE、MAPE、$R^2$、
-
统计推断与假设检验:分布族、极大似然、中心极限定理、p-value、置信区间与功效分析全景
> **核心摘要**:统计推断是将带噪声的数据转化为经过校准的决策的学科,而假设检验是把证据转换为结论的引擎。本指南构建完整链路:常用分布族工具箱(正态、χ²、t、F、泊松、伯努利);为大样本推断背书的**中心极限定理 (CLT)**;经由**极大似然估计 (MLE)** 与**矩估计**实现点估计并给出无偏性、一致性
-
经典与深度强化学习全景:MDP 体系、Bellman 最优方程、DQN、Policy Gradient、PPO 与 SAC 原理解构
> **核心摘要**:强化学习 (Reinforcement Learning, RL) 是研究智能体 (Agent) 在与动态环境交互过程中,如何通过试错 (Trial-and-Error) 学习最优策略 $pi(a|s)$ 以最大化累积折扣回报的数理科学。从经典表格型 Q-Learning 到结合深度神经网络的
-
搜索与计算广告系统设计:Query 意图理解、分布式倒排索引、RTB 竞价与 pCTR 预估
> **核心摘要**:搜索与广告是同一漏斗的两面:理解用户意图 → 海量候选检索 → 按相关性(广告还需按期望收入)排序 → 在严格延迟预算内混排与投放。搜索侧,本指南覆盖 Query 理解、分布式倒排索引、Recall@K / MRR / NDCG 指标族与 Pointwise/Pairwise/Listwise 学
-
DS Core Cheatsheet: Causal Inference, A/B Testing & Drift
> **Executive Summary**: The fundamental mandate of a Data Scientist (DS) is to drive business growth through rigorous statistical inference, causal identificat
-
RS Experiment Design & Reproducible Research: Ablations, Seed Control, Hyperparameter Search & the Full Reproducibility Checklist
> **Core Executive Summary**: In Research Scientist (RS) interviews — and in research itself — the difference between a credible paper and an irreproducible one
-
Tool Use & Function Calling: Toolformer Self-Taught Calls, JSON Schema & Sandbox Execution
> **Core Executive Summary**: LLMs cannot query real-time APIs or execute code natively. **Tool Use** and **Function Calling** bridge this gap by enabling LLMs