PAPER·June 2, 2026HumanNOVA: Photorealistic, Universal and Rapid 3D Human Avatar Modeling from a Single ImagearXiv
PAPER·June 2, 2026VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time OptimizationarXiv
PAPER·June 2, 2026From Layers to Submodules: Rethinking Granularity in Replacement-Based LLM CompressionarXiv
PAPER·June 2, 2026LongLive-RAG: A General Retrieval-Augmented Framework for Long Video GenerationarXiv
PAPER·June 2, 2026IMAC-AgriVLN: Can Agricultural Vision-and-Language Navigation Agents be Aware of Instruction Mistakes?arXiv
PAPER·June 2, 2026GloResNet: A lightweight 3D CNN with global topological features for preterm brain injury predictionarXiv
PAPER·June 2, 2026MCP-Persona: Benchmarking LLM Agents on Real-World Personal Applications via Environment SimulationarXiv