Library

Subject
Tags

6,330 matches · Advanced Bandit Algorithms Research

#
001D <sup>3</sup> MBR: Dual-Level Diffusion Denoiser with Preference Guidance for Multi-Behavior RecommendationOpenAlexPaperYangtao Zhou, Xiangming Li et al.6 days ago
002C-SOUL: A Principled Framework for Preference Expansion via Causal Deconfounding and Offline Reinforcement LearningOpenAlexPaperMuhammad Talha7 days ago
003C-SOUL: A Principled Framework for Preference Expansion via Causal Deconfounding and Offline Reinforcement LearningOpenAlexPaperMuhammad Talha7 days ago
004Adaptive Mode Learning for Nonstationary Streaming DataOpenAlexPaperTao WangJul 23
005Adaptive Mode Learning for Nonstationary Streaming DataOpenAlexPaperTao WangJul 23
006GPALexpOpenAlexPaperJunyup Kim, Chaeho LeeJul 23
007Tight Streaming Lower Bounds for Deterministic Approximate CountingOpenAlexPaperYichuan WangJul 22
008Temporal evolution-aware adaptive sampling for open-set active learningOpenAlexPaperJiasai Wu, Zhuo Zhang (72795) et al.Jul 20
009Model Reliability Under Temporal Distribution Shift: An Empirical Study Using the ELEC2 DatasetOpenAlexPaperKulhade, Mrinank, Kulhade, MrinankJul 19
010Model Reliability Under Temporal Distribution Shift: An Empirical Study Using the ELEC2 DatasetOpenAlexPaperKulhade, Mrinank, Kulhade, MrinankJul 19
011Adaptive nonlinear learning framework with dynamic representations for scalar-on-function regressionOpenAlexPaperJiayu Shang, Xiao‐Jun ZengJul 17
012Optimization for Machine LearningOpenAlexPaperSteven L. BruntonJul 16
013Is Deep Hedging Reinforcement Learning?OpenAlexPaperFrédéric GodinJul 15
014KuaiLive: A Real-time Interactive Dataset for Live Streaming RecommendationOpenAlexPaperChangle Qu, Sunhao Dai et al.Jul 15
015A multi-agent game-theoretic adversarial training framework with latency-aware reward shaping for robust high-frequency trading strategy designOpenAlexPaperYJ LiJul 13
016Regret-weighted Bayes Fusion for Distributed Experimental DesignOpenAlexPaperNagananda K G, Lav R. Varshney et al.Jul 13
017Adaptive Sampling Bayesian Personalized Ranking via Posterior EntropyOpenAlexPaperJincheng ZhangJul 11
018Adaptive Sampling Bayesian Personalized Ranking via Posterior EntropyOpenAlexPaperJincheng ZhangJul 11
019Adversarial Bayesian Personalized Ranking with Selective Hard Negative Sampling for Implicit Feedback RecommendationOpenAlexPaperJincheng ZhangJul 11
020Adversarial Bayesian Personalized Ranking with Selective Hard Negative Sampling for Implicit Feedback RecommendationOpenAlexPaperJincheng ZhangJul 11
021Asymmetric Confidence Bayesian Personalized Ranking for Recommendation with Non-Uniform Posterior Update RatesOpenAlexPaperJincheng ZhangJul 11
022Asymmetric Confidence Bayesian Personalized Ranking for Recommendation with Non-Uniform Posterior Update RatesOpenAlexPaperJincheng ZhangJul 11
023Bayesian Memory Network BPR: Leveraging External Memory Bank for Long-Term Preference RetrievalOpenAlexPaperJincheng ZhangJul 11
024Bayesian Memory Network BPR: Leveraging External Memory Bank for Long-Term Preference RetrievalOpenAlexPaperJincheng ZhangJul 11
025Bayesian Personalized Ranking with Posterior-Difference Optimization for Top-N RecommendationOpenAlexPaperJincheng ZhangJul 11
026Bayesian Personalized Ranking with Posterior-Difference Optimization for Top-N RecommendationOpenAlexPaperJincheng ZhangJul 11
027Causal-BPR: Causal Bayesian Personalized Ranking for Unbiased Recommendation under Exposure BiasOpenAlexPaperJincheng ZhangJul 11
028Causal-BPR: Causal Bayesian Personalized Ranking for Unbiased Recommendation under Exposure BiasOpenAlexPaperJincheng ZhangJul 11
029Counterfactual Bayesian Ranking: De-biasing Exposure Bias in Personalized Recommendation via Potential OutcomesOpenAlexPaperJincheng ZhangJul 11
030Counterfactual Bayesian Ranking: De-biasing Exposure Bias in Personalized Recommendation via Potential OutcomesOpenAlexPaperJincheng ZhangJul 11
031Distribution-Aligned Bayesian Personalized Ranking for Personalized RecommendationOpenAlexPaperJincheng ZhangJul 11
032Distribution-Aligned Bayesian Personalized Ranking for Personalized RecommendationOpenAlexPaperJincheng ZhangJul 11
033Dual-Process Bayesian BPR: A Joint Ranking Recommendation Algorithm via Fast Heuristic Posterior and Slow Precise Bayesian InferenceOpenAlexPaperJincheng ZhangJul 11
034Dual-Process Bayesian BPR: A Joint Ranking Recommendation Algorithm via Fast Heuristic Posterior and Slow Precise Bayesian InferenceOpenAlexPaperJincheng ZhangJul 11
035Noise-Separated Bayesian Personalized Ranking for Robust Implicit RecommendationOpenAlexPaperJincheng ZhangJul 11
036Noise-Separated Bayesian Personalized Ranking for Robust Implicit RecommendationOpenAlexPaperJincheng ZhangJul 11
037Probability Flow BPR: Modeling Personalized Ranking via Continuous-Time Bayesian Evolution of User PreferencesOpenAlexPaperJincheng ZhangJul 11
038Probability Flow BPR: Modeling Personalized Ranking via Continuous-Time Bayesian Evolution of User PreferencesOpenAlexPaperJincheng ZhangJul 11
039Research on Recommendation Algorithm Based on Memory-Decay Bayesian Personalized RankingOpenAlexPaperJincheng ZhangJul 11
040Research on Recommendation Algorithm Based on Memory-Decay Bayesian Personalized RankingOpenAlexPaperJincheng ZhangJul 11
041Anytime-valid admission control for growing an inherited executable knowledge baseOpenAlexPaperAdam HillierJul 10
042Anytime-valid admission control for growing an inherited executable knowledge baseOpenAlexPaperAdam HillierJul 10
043AsarRec: Adaptive Sequential Augmentation for Robust Self-supervised Sequential RecommendationOpenAlexPaperKaike Zhang, Qi Cao et al.Jul 10
044Balanced Frequency Decoupling: Energy-Aware Multi-Scale Preference Modeling for Sequential RecommendationOpenAlexPaperJiahao Hu, Wei Zhou et al.Jul 10
045Countering Interest Over-Smoothing: Distilling Latent Factors via Diffusion for Multi-Interest RetrievalOpenAlexPaperYankun Le, Fu Zhang et al.Jul 10
046FEDIN: Frequency-Enhanced Deep Interest Network for Click-Through Rate PredictionOpenAlexPaperZ. Dai, Jinpeng Wang et al.Jul 10
047Large-Scale Online Learning for Generative List Recommendation in E-commerce: An Environment Policy Optimization ApproachOpenAlexPaperYuan Wang, Zhiyu Li et al.Jul 10
048Reinforcing User Interest Evolution in Multi-Scenario Learning for recommender systemsOpenAlexPaperZhijian Feng, Wenhao Zheng et al.Jul 10
049Similarity-based Portfolio Construction for Black-box OptimizationOpenAlexPaperCatalin-Viorel Dinu, Diederick Vermetten et al.Jul 10
050Time-Interval-Aware Disentangled Expert Modeling for Next-Basket RecommendationOpenAlexPaperZhiying Deng, Yuan Fu et al.Jul 10
051A Multi-Agent Reinforcement Learning Framework for Personalized Product Recommendation in Live-Streaming E-Commerce: Integrating Improved QMIX with Graph Attention Networks and Deep Reinforcement LearningOpenAlexPaperZihan Yang, Sibo Wang et al.Jul 9
052Tackling decision dependency in contextual stochastic optimizationOpenAlexPaperWenxuan Liu, Xiangting Liu et al.Jul 9
053Estimating Causal Effects from Data Generated by Stochastic AlgorithmsOpenAlexPaperSusan Athey, Guido Imbens et al.Jul 7
054Estimating Causal Effects from Data Generated by Stochastic AlgorithmsOpenAlexPaperSusan Athey, Guido Imbens et al.Jul 7
055Estimating Causal Effects from Data Generated by Stochastic AlgorithmsOpenAlexPaperSusan Athey, Guido Imbens et al.Jul 7
056Estimating Causal Effects from Data Generated by Stochastic AlgorithmsOpenAlexPaperSusan Athey, Guido Imbens et al.Jul 7
057Exploration and Exploitation: A Study on Sample Efficiency in Reinforcement Learning With Multifaceted Curiosity Rewards and Adaptive Experience Replay Utilisation in Sparse Reward EnvironmentsOpenAlexPaperJingyi Huang, GuiPeng Xi et al.Jul 7
058A video statistics-aware sequential recommendation model with multi-behavior feedback for short-video recommendationOpenAlexPaperXinyi Zhou, Huanhuan Xu et al.Jul 6
059Regret Is Weighted ForgettingOpenAlexPaperMichael Timothy BennettJul 6
060Sparsity-preserving gradient utility tools for PyTorchOpenAlexPaperTheodore Barfoot, Ben Glocker et al.Jul 6

Showing 60 of 6,330 documents · scroll for more