PAPER·May 13, 2026Overview of the MedHopQA track at BioCreative IX: track description, participation and evaluation of systems for multi-hop medical question answeringarXiv
PAPER·May 13, 2026From Model Uncertainty to Human Attention: Localization-Aware Visual Cues for Scalable Annotation ReviewarXiv
PAPER·May 13, 2026EgoEV-HandPose: Egocentric 3D Hand Pose Estimation and Gesture Recognition with Stereo Event CamerasarXiv
PAPER·May 13, 2026Instruction Lens Score: Your Instruction Contributes a Powerful Object Hallucination Detector for Multimodal Large Language ModelsarXiv
PAPER·May 13, 2026Mind the Pause: Disfluency-Aware Objective Tuning for Multilingual Speech Correction with LLMsarXiv
PAPER·May 13, 2026UHR-Micro: Diagnosing and Mitigating the Resolution Illusion in Earth Observation VLMsarXiv
PAPER·May 13, 2026TMRL: Diffusion Timestep-Modulated Pretraining Enables Exploration for Efficient Policy FinetuningarXiv
PAPER·May 12, 2026MolDeTox: Evaluating Language Model's Stepwise Fragment Editing for Molecular DetoxificationarXiv
PAPER·May 12, 2026SyncDPO: Enhancing Temporal Synchronization in Video-Audio Joint Generation via Preference LearningarXiv