G-MAD: A Game-Based Data Generation Framework for Multi-View RGB-T Aerial Object Detection Paper • 2607.19942 • Published 5 days ago • 4
Ideas Have Genomes: Benchmarking Scientific Lineage Reasoning and Lineage-Grounded Idea Generation Paper • 2607.08758 • Published 18 days ago • 41
The Mirage of Optimizing Training Policies: Monotonic Inference Policies as the Real Objective for LLM Reinforcement Learning Paper • 2606.29526 • Published 29 days ago • 170
timaeus/rl-lm-pythia160m-sentiment-pos-beta0-grpo-nostd-gs4-tp1-tk0-pt80000-steerDotIncL3c128s1-seed21 Updated 23 days ago • 2 • 1
CM-EVS: Sparse Panoramic RGB-D-Pose Data for Complete Scene Coverage Paper • 2605.15597 • Published May 15 • 11
Anti-Self-Distillation for Reasoning RL via Pointwise Mutual Information Paper • 2605.11609 • Published May 12 • 196