Running Agents 1 SLR-Bench Leaderboard - Reward Hacking in Reasoning Models 🎯 1 Reward shortcut behavior in LLMs via IPT
Sleeping Agents 1 Isomorphic Perturbation Testing 🔍 1 Evaluate rule hypotheses for genuine reasoning vs shortcuts
Sleeping Agents 1 VerifiableRewardsForScalableLogicalReasoning 🚀 1 Evaluate logical rules with a validation program