遗憾界 共 1 篇文章

在线学习的遗憾界分析:Follow the Regularized Leader算法
2026-07-25 06:43:13
在线学习的遗憾界分析:Follow the Regularized Leader算法 在线学习是一种逐步决策的框架:在第 t 轮,你选择一个动作(如预测值),然后看到损失,目标是最小化累计损失。遗憾衡量你的累计损失与最佳固定动作(事后看)的累计损失之差。Follow the Regularized
在线学习 遗憾界 FTRL算法
30 0