[EMNLP'25] s3 - ⚡ Efficient & Effective Search Agent Training via RL for RAG (RLVR for Search with Minimal Data)
[ICLR 2024] Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning