TailBooster: A Dual-Layer Generative Framework for Extreme Value Augmentation with Operational Validity Enforcement Paper • 2608.11951 • Published 4 days ago • 4
OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution Paper • 2608.00677 • Published 15 days ago • 252
On-Policy Delta Distillation for Multilingual Math Reasoning Paper • 2608.05802 • Published 10 days ago • 32
AISPA: User-Centric System Prompt Auditing for Large Language Model Applications Paper • 2607.28617 • Published 17 days ago • 37