TailBooster: A Dual-Layer Generative Framework for Extreme Value Augmentation with Operational Validity Enforcement Paper • 2608.11951 • Published 5 days ago • 4
OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution Paper • 2608.00677 • Published 16 days ago • 253
On-Policy Delta Distillation for Multilingual Math Reasoning Paper • 2608.05802 • Published 11 days ago • 32
AISPA: User-Centric System Prompt Auditing for Large Language Model Applications Paper • 2607.28617 • Published 18 days ago • 37