Learning the Preferences of a Learning Agent Karim Abdel Sadek*, Mark Bedaywi*, Rhys Gould*, Stuart Russell MALGAI Workshop, ICLR 2026 Paper
Mitigating Goal Misgeneralization via Minimax Regret Karim Abdel Sadek*, Matthew Farrugia-Roberts*, Usman Anwar, Hannah Erlebach, Christian Schroeder de Witt, David Krueger, Michael Dennis RLC 2025 Paper Code Slides Poster
Dynamic Vocabulary Pruning in Early-Exit LLMs Jort Vincenti*, Karim Abdel Sadek*, Joan Velja*, Matteo Nulli*, Metod Jazbec ENLSP Workshop, NeurIPS 2024 Paper Code
Algorithms for Caching and MTS with reduced number of predictions Karim Abdel Sadek, Marek Eliáš ICLR 2024 Paper
'Explaining RL Decisions with Trajectories': A Reproducibility Study Karim Abdel Sadek, Matteo Nulli, Joan Velja, Jort Vincenti TMLR 2024 Paper Code