PAPER·June 1, 2026GDSD: Reinforcement Learning as Guided Denoiser Self-Distillation for Diffusion Language ModelsHugging Face Papers
PAPER·June 1, 2026Beyond Holistic Models: Systematic Component-level Benchmarking of Deep Multivariate Time-Series ForecastingHugging Face Papers
PAPER·June 1, 2026Flat-Pack Bench: Evaluating Spatio-Temporal Understanding in Large Vision-Language Models through Furniture AssemblyHugging Face Papers
PAPER·June 1, 2026SAAS: Self-Aware Reinforcement Learning for Over-Search Mitigation in Agentic SearchHugging Face Papers
PAPER·June 1, 2026DecMem: Towards Minute-Long Consistent World Generation with Decoupled MemoryHugging Face Papers
PAPER·June 1, 2026SoundnessBench: Can Your AI Scientist Really Tell Good Research Ideas from Bad Ones?Hugging Face Papers
PAPER·June 1, 2026Emergent Languages in Populations of Language Model Agents: From Token Efficiency to Oversight EvasionHugging Face Papers
PAPER·June 1, 2026PEEK: Picking Essential frames via Efficient Knowledge DistillationHugging Face Papers
PAPER·June 1, 2026iVGR: Internalizing Visually Grounded Reasoning for MLLMs with Reinforcement LearningHugging Face Papers
PAPER·June 1, 2026Benchmarking Composed Image Retrieval for Applied Earth ObservationHugging Face Papers
PAPER·June 1, 2026DRIFT: Decoupled Rollouts and Importance-Weighted Fine-Tuning for Efficient Multi-Turn OptimizationHugging Face Papers