Tacit-TTS: From Autoregressive Decoding to Masked Prediction for Efficient Transcript-Free Voice Cloning Paper • 2609.38658 • Published 8 days ago • 12
Working Around the Compute Ceiling: Byte-Exact Memory in Galahad Makes LLM Reading a One-Time Cost LLM Reading a One-Time Cost Paper • 2609.39358 • Published 7 days ago • 3
BiasReducer: Adaptive Bias Mitigation for Reward Models Paper • 2609.32720 • Published 11 days ago • 25
On-Policy or Off-Policy Learning? A Systematic Study of Distillation Dynamics Paper • 2609.35259 • Published 9 days ago • 188
Better Supervision Is Nearby: Neighborhood On-Policy Self-Distillation Paper • 2609.39687 • Published 7 days ago • 18
Decoding Looped Transformers Better for (Almost) Free Paper • 2610.02185 • Published 6 days ago • 43
Label-free steering: Compressing test-time reinforcement learning into bias-only subspaces Paper • 2609.18587 • Published 9 days ago • 4
Synthetic Pre-pretraining Survives Scale, but Not as a Grammatical Prior Paper • 2609.39827 • Published 7 days ago • 12
Overcoming Scaling Limits in On-Policy Self-Distillation for LLM Reasoning Paper • 2609.37915 • Published 8 days ago • 8
Not Every Token Is Worth Distilling: Selective Supervision for Direct-OPD Paper • 2609.29142 • Published 11 days ago • 5
The Teacher Is a Direction, Not a Destination: Extrapolating RL-Induced Representation Residuals in On-Policy Distillation Paper • 2609.36484 • Published 8 days ago • 578
SLCA-GRPO: Resolving Cross-Segment Credit Misattribution in Tool-Calling RL Paper • 2609.29050 • Published 13 days ago • 13
Block Sparse Attention with Log-Linear Complexity Paper • 2609.31093 • Published 12 days ago • 30
Just Ask Jev: Reinforcement Learning for Calibrated Decisions as a Zero-Shot Detector of AI Alignment Failures Paper • 2609.29429 • Published 13 days ago • 29
Six Layers Less: Encoder Pruning for Whisper with Label-Free Recovery Paper • 2609.27980 • Published 14 days ago • 6
Capable yet Parsimonious: Extracting and Characterizing Hidden Chain-of-Thought in Frontier Models Paper • 2609.26637 • Published 15 days ago • 26
Your Transformer Can Hold Two Thoughts at Once: Evidence of Linear Superposition in LLMs Paper • 2609.29845 • Published 13 days ago • 104