PAPER·May 19, 2026A Large-Scale Study on the Accuracy vs Cost Trade-offs of Training and Evaluation Settings in Fine-Grained Image RecognitionarXiv
PAPER·May 19, 2026Articulation in Prime: Primitive-Based Articulated Object Understanding from a Single Casual VideoarXiv
PAPER·May 19, 2026SCICONVBENCH: Benchmarking LLMs on Multi-Turn Clarification for Task Formulation in Computational SciencearXiv
PAPER·May 19, 2026CrossView Suite: Harnessing Cross-view Spatial Intelligence of MLLMs with Dataset, Model and BenchmarkarXiv
PAPER·May 19, 2026Dance Across Shifts: Forward-Facilitation Continual Test-Time Adaptation through Dynamic Style BridgingarXiv
PAPER·May 19, 2026Incantation: Natural Language as the Action Interface for Multi-Entity Video World ModelsarXiv