PAPER·July 30, 2026CoRT: Counterfactual Replay for Token-Level Rubric-Guided Policy OptimizationHugging Face Papers
PAPER·July 30, 2026SkillRise: Agentic Reinforcement Learning for Cross-Task Skill EvolutionHugging Face Papers
PAPER·July 30, 2026DecoEvo: Score-Decoupled Co-Evolution of Solver and Rubric-Generator Skills in Text SpaceHugging Face Papers
PAPER·July 30, 2026StealthBench: Measuring Operational Stealth in Autonomous Offensive-Security AgentsHugging Face Papers
PAPER·July 30, 2026TurboVLA: Real-Time Vision-Language-Action Model at 32 Hz on an RTX 4090 with <1 GB VRAMHugging Face Papers
PAPER·July 30, 2026Explicit Layer Modeling for Video Object Insertion and Layer DecompositionHugging Face Papers
PAPER·July 29, 2026GLI-AL: A Multi-Modal Glioma MRI Label Resource with Unified Anatomy-Lesion LabelsHugging Face Papers
PAPER·July 29, 2026CodeNib: A Multi-View Data System for Serving Repository Context to Coding AgentsHugging Face Papers