All accepted contributions in alphabetical order:
Adaptive Doubly Robust Off-Policy Evaluation for Ranking Policies under Diverse User Behavior [arXiv]
Kosuke Iguchi and Ren Kishimoto
Auditing Return Conditioning as a Control Knob: An Offline Diagnostic for Decision Transformer Recommendation [arXiv]
Jingyu Wang
Between-User Collapse Under Popularity-Biased Feedback: A Centered-Covariance Theorem and Computable Phase Boundary [arXiv]
Sahil Medepalli
Beyond Raw Engagement: A Counterfactual Observability Framework for Recommender Systems at Netflix [arXiv]
Chaoran Guo, Ding Tong, Ting-Po Lee and Scarlet Chen
Following the Eye-Tracking Evidence: Established Web-Search Assumptions Fail in Carousel Interfaces [arXiv]
Jingwei Kang, Maarten de Rijke and Harrie Oosterhuis
From Prompting to Behavioral Alignment: Personalized LLM Judges for Recommendation Evaluation [arXiv]
Alireza Salkhordeh Ziabari, Kat Ellis, Colleen Chan and Ding Tong
Incremental Recommendation via Causal Models [arXiv]
Athanasios Vlontzos, David Gustafsson, Michael O'Riordan and Ciarán Gilligan-Lee
Medical Causal Hypothesis Verification with Large Language Models [arXiv]
Safiyyah Ahmed, Abrar Ansari, Md Aminul Islam and Elena Zheleva
Off-Policy Evaluation for Semantic ID Recommenders: Does the Model’s Own Code Hierarchy Help? [arXiv]
Artem Betlei
Revisiting N2DCG: An Empirically Grounded Reformulation of Carousel Recommendation Evaluation [arXiv]
Jingwei Kang, Santiago de Leon-Martinez, Maarten de Rijke and Harrie Oosterhuis
Risk Optimization for Learning to Rank through Portfolio Theory [pdf]
Oscar Ramirez Milian and Harrie Oosterhuis
Stageboost: Recommending Signals based on Counterfactual Estimations [arXiv]
Darpan Singhal, Matan Mandelbrod, Tal Franji, Manasa Kolla, Vipul Gaba and Yuri Brovman