在训练模型的过程中,使用tf.losses.log_loss计算二分类loss,随着训练的深入,loss值为NaN,最终模型训练失败。排查下来发现是该函数存在数值不稳定的情况。
-
tf.nn.sigmoid_cross_entropy_with_logits & tf.losses.log_loss
-
自动驾驶L1~L5
自动驾驶的L1到L5分级,是目前全球最通用的标准,由国际汽车工程师学会(SAE International)制定,用来定义一辆车的“聪明”程度。
-
市盈率
在金融领域,PE 通常指 市盈率(Price-to-Earnings Ratio),是评估股票估值水平最常用的指标之一。
-
Hitrate介绍
Hitrate(命中率)是一个用于评估召回阶段效果的指标。它的核心逻辑是看系统在召回阶段能不能”猜中”用户最终真正感兴趣的那些物品。
-
On-policy VS Off-policy
此前对于rl的这两个概念一直很模糊,在此整理一下。
-
AIGB:用扩散模型颠覆传统自动出价范式
这是阿里巴巴在广告自动出价的一篇工作,用扩散模型颠覆了传统深度rl出价的范式,取得了线上线下的巨大收益。
-
MFU
MFU(Model FLOPs Utilization,模型浮点运算利用率) 是衡量深度神经网络(DNN)在训练或推理过程中硬件计算效率的关键指标。它回答了一个核心问题:
“我们的 GPU/TPU 算力,到底有多少真正用在了模型计算上?”
-
毫米波雷达&激光雷达
在自动驾驶和智能感知领域,毫米波雷达和激光雷达都是不可或缺的组件。
-
EOM公式推导
在uplift建模中,除了AUUC、QINI指标,还有EOM。它是基于离线RCT模拟评估在线业务收益的指标,EOM越高,业务收益越高。
-
图像生成评估指标IS&FID
IS(Inception Score) 和 FID(Fréchet Inception Distance) 是评估生成模型(特别是GAN、Diffusion等)最常见的两个指标