Where Quality Breaks in Compressed Short-Text Generation: Staged Bottleneck Localization Paper • 2607.24176 • Published 3 days ago • 2
COSPADI: Compressing LLMs via Calibration-Guided Sparse Dictionary Learning Paper • 2509.22075 • Published Sep 26, 2025 • 23
ReplaceMe: Network Simplification via Depth Pruning and Transformer Block Linearization Paper • 2505.02819 • Published Feb 19 • 26
Iterative Self-Training for Code Generation via Reinforced Re-Ranking Paper • 2504.09643 • Published Apr 13, 2025 • 34
The Differences Between Direct Alignment Algorithms are a Blur Paper • 2502.01237 • Published Feb 3, 2025 • 113