PAPER·May 22, 2026DelTA: Discriminative Token Credit Assignment for Reinforcement Learning from Verifiable RewardsHugging Face Papers
PAPER·May 22, 2026FlowLong: Inference-time Long Video Generation via Manifold-constrained Tweedie MatchingHugging Face Papers
PAPER·May 22, 2026Maestro: Reinforcement Learning to Orchestrate Hierarchical Model-Skill EnsemblesHugging Face Papers
PAPER·May 22, 2026Perception or Prejudice: Can MLLMs Go Beyond First Impressions of Personality?Hugging Face Papers
PAPER·May 22, 2026KVServe: Service-Aware KV Cache Compression for Communication-Efficient Disaggregated LLM ServingHugging Face Papers
PAPER·May 22, 2026Sensor2Sensor: Cross-Embodiment Sensor Conversion for Autonomous DrivingHugging Face Papers
PAPER·May 22, 2026Same Architecture, Different Capacity: Optimizer-Induced Spectral Scaling LawsHugging Face Papers
PAPER·May 22, 2026From Reasoning Chains to Verifiable Subproblems: Curriculum Reinforcement Learning Enables Credit Assignment for LLM ReasoningHugging Face Papers
PAPER·May 22, 2026π-Bench: Evaluating Proactive Personal Assistant Agents in Long-Horizon WorkflowsHugging Face Papers
PAPER·May 22, 2026WorldKV: Efficient World Memory with World Retrieval and CompressionHugging Face Papers