ReMix: Reinforcement routing for mixtures of LoRAs in LLM finetuning Paper • 2603.10160 • Published Mar 10 • 26
Empowering Multi-Turn Tool-Integrated Reasoning with Group Turn Policy Optimization Paper • 2511.14846 • Published Nov 18, 2025
NTK-approximating MLP Fusion for Efficient Language Model Fine-tuning Paper • 2307.08941 • Published Jul 18, 2023 • 1
Towards Unified Multi-Modal Personalization: Large Vision-Language Models for Generative Recommendation and Beyond Paper • 2403.10667 • Published Mar 15, 2024 • 1
SelfElicit: Your Language Model Secretly Knows Where is the Relevant Evidence Paper • 2502.08767 • Published Feb 12, 2025
Saffron-1: Towards an Inference Scaling Paradigm for LLM Safety Assurance Paper • 2506.06444 • Published Jun 6, 2025 • 73
CORG: Generating Answers from Complex, Interrelated Contexts Paper • 2505.00023 • Published Apr 25, 2025 • 9
BlobCtrl: A Unified and Flexible Framework for Element-level Image Generation and Editing Paper • 2503.13434 • Published Mar 17, 2025 • 28
RCOT: Detecting and Rectifying Factual Inconsistency in Reasoning by Reversing Chain-of-Thought Paper • 2305.11499 • Published May 19, 2023
CREATOR: Disentangling Abstract and Concrete Reasonings of Large Language Models through Tool Creation Paper • 2305.14318 • Published May 23, 2023
Large Language Models on Graphs: A Comprehensive Survey Paper • 2312.02783 • Published Dec 5, 2023 • 2
LISA: Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning Paper • 2403.17919 • Published Mar 26, 2024 • 16
Eliminating Position Bias of Language Models: A Mechanistic Approach Paper • 2407.01100 • Published Jul 1, 2024 • 8
MentalArena: Self-play Training of Language Models for Diagnosis and Treatment of Mental Health Disorders Paper • 2410.06845 • Published Oct 9, 2024 • 5
SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution Paper • 2502.18449 • Published Feb 25, 2025 • 75