Skip to yearly menu bar Skip to main content


Poster Sat, Apr 25, 2026 • 3:15 PM – 5:45 PM -03

Strategic Dishonesty Can Undermine AI Safety Evaluations of Frontier LLMs

Alexander Panfilov ⋅ Evgenii Kortukov ⋅ Kristina Nikolić ⋅ Matthias Bethge ⋅ Sebastian Lapuschkin ⋅ Wojciech Samek ⋅ Ameya Prabhu ⋅ Maksym Andriushchenko ⋅ Jonas Geiping

Abstract

Video

Chat is not available.