DHDemis HassabisNov 12, 2025New paperautoPaperOlympiad-level formal mathematical reasoning with reinforcement learningNature · 2025 · Thomas Hubert, Rishi Mehta, Laurent Sartran et al.