Skip to yearly menu bar Skip to main content


Poster Sat, Apr 25, 2026 • 3:15 PM – 5:45 PM -03

MARSHAL: Incentivizing Multi-Agent Reasoning via Self-Play with Strategic LLMs

Huining Yuan ⋅ Zelai Xu ⋅ Zheyue Tan ⋅ Xiangmin Yi ⋅ Mo Guang ⋅ Kaiwen Long ⋅ Haojia Hui ⋅ BOXUN LI ⋅ Xinlei Chen ⋅ Bo Zhao ⋅ Xiao-Ping Zhang ⋅ Chao Yu ⋅ Yu Wang

Abstract

Video

Chat is not available.