PPaperPicks

Yutao Yue

22 papers at tracked venues · 12 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Guided Path Sampling: Steering Diffusion Models Back on Track with Principled Path Guidance
  2. RadioAR: Autoregressive Modeling for Accurate Radio Map Estimation
  3. RoadSceneVQA: Benchmarking Visual Question Answering in Roadside Perception Systems for Intelligent Transportation System
  4. Towards Better Evaluation Metrics for Text-to-Motion Generation
  5. ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model
  6. BioD2C: A Dual-Level Semantic Consistency Constraint Framework for Biomedical VQA
  7. CD2: Constrained Dataset Distillation for Few-Shot Class-Incremental Learning
  8. CFSSeg: Closed-Form Solution for Class-Incremental Semantic Segmentation of 2D Images and 3D Point Clouds
  9. Can GRPO Boost Complex Multimodal Table Understanding?
  10. DRIVE: Dependable Robust Interpretable Visionary Ensemble Framework in Autonomous Driving
  11. From Guesswork to Guarantee: Towards Faithful Multimedia Web Forecasting with TimeSieve
  12. IMTS is Worth Time × Channel Patches: Visual Masked Autoencoders for Irregular Multivariate Time Series Prediction
  13. Learning New Concepts, Remembering the Old: Continual Learning for Multimodal Concept Bottleneck Models
  14. NUMINA: A Natural Understanding Benchmark for Multi-dimensional Intelligence and Numerical Reasoning Abilities
  15. NanoMVG: USV-Centric Low-Power Multi-Task Visual Grounding based on Prompt-Guided Camera and 4D mmWave Radar
  16. Physics-Informed Representation Alignment for Sparse Radio-Map Reconstruction
  17. Talk2Radar: Bridging Natural Language with 4D mmWave Radar for 3D Referring Expression Comprehension
  18. Text2Weight: Bridging Natural Language and Neural Network Weight Spaces
  19. UniBEVFusion: Unified Radar-Vision Bevfusion for 3D Object Detection
  20. VQualA 2025 Challenge on Face Image Quality Assessment: Methods and Results
  21. ASY-VRNet: Waterway Panoptic Driving Perception Model based on Asymmetric Fair Fusion of Vision and 4D mmWave Radar
  22. MMNeuron: Discovering Neuron-Level Domain-Specific Interpretation in Multimodal Large Language Model