差分隐私多臂赌博机算法
本文提出了一种在随机模型下割臀膜机制下的多臂老虎机问题的差分隐私算法,其分别对应具体分布相关和分布无关两种后悔下界,并给出最优算法上界和良好的本地模型表现。
Jun, 2021
本研究使用对数批量查询和不同的隐私模型提出不同关于武断攻击的差分隐私和鲁棒性阿姆淘汰算法,实现同时在随机线性医生问题中提供差分隐私和对手强度的功能,并提供相应的遗憾界限。
Apr, 2023
本文研究了随机预算多臂赌博问题,并提出了一种名为 ω-UCB 的新的上置信界(UCB)采样策略,该策略使用了不对称置信区间,并表明该方法具有对数遗憾且在合成和真实设置中始终优于现有策略。
Jun, 2023
该研究探讨具有随机延迟的随机多臂赌博问题,在考虑了奖励相关延迟和奖励无关延迟两种情况下,提出了接近最优的算法,并在延迟分布的分位数上增加了附加依赖性,而不需要假设延迟分布来自任何参数化的分布族,还允许无限延迟的情况。
Jun, 2021
本文研究了具有差分隐私和强局部差分隐私的组合半臂赌博问题,证明了在常见平滑性假设下,该算法可以消除额外的依赖于数据维度的副作用,并且获得了最优的损失界限,表明在这些普遍的设置下,组合半臂赌博的方法没有额外的价格。
Jun, 2020
本文研究了一种分散式多臂搏击器的问题,提出了一种达到最优秩序并确保公平性的分散式政策,并证明了其总遗憾增长速率的下限,这个问题在认知无线电网络,多通道通信系统,多智能体系统,网络搜索和广告以及社交网络等领域有潜在的应用。
Oct, 2009
设计一种不使用奖励分布信息的多臂赌博机算法,通过交替应用贪婪规则与强制探索来实现显著的后悔上界,并提供不同强制探索策略下的问题依赖性后悔上界分析方法,适用于不同奖励分布的固定和分段固定设置。
Dec, 2023
提出了两种多用户多臂赌博机算法框架,分别适用于随机环境和对抗环境下无协调频谱访问问题。算法可在不知道用户数量的情况下,通过估计和分配两个阶段实现高概率下的常数系统累积失误和次线性系统累积失误,并能够处理用户数量随时间改变的动态问题。
Jul, 2018