PPaperPicks

Yang Cao

University of Science and Technology of China, Department of Automation, Hefei, China

31 papers at tracked venues · 27 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. E-MaT: Event-oriented Mamba for Egocentric Point Tracking
  2. I²B-LPO: Latent Policy Optimization via Iterative Information Bottleneck
  3. BRAT: Bidirectional Relative Positional Attention Transformer for Event-based Eye tracking
  4. Benchmarking Large Vision-Language Models via Directed Scene Graph for Comprehensive Image Captioning
  5. Boosting Image De-Raining via Central-Surrounding Synergistic Convolution
  6. Curr-ReFT: Overcoming Training Bottlenecks in Small-scale Vision-Language Models via Curriculum Reinforcement Finetuning
  7. Directing Mamba to Complex Textures: An Efficient Texture-Aware State Space Model for Image Restoration
  8. EF-3DGS: Event-Aided Free-Trajectory 3D Gaussian Splatting
  9. Emotive: Event-Guided Trajectory Modeling for 3D Motion Estimation
  10. Event-based eye tracking. Even-based Vision Workshop 2025
  11. GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding
  12. HERO: Human Reaction Generation from Videos
  13. INFP: INdustrial Video Anomaly Detection via Frequency Prioritization
  14. Improved Video VAE for Latent Video Diffusion Model
  15. MATE: Motion-Augmented Temporal Consistency for Event-Based Point Tracking
  16. MMAR: Towards Lossless Multi-Modal Auto-Regressive Probabilistic Modeling
  17. PMQ-VE: Progressive Multi-Frame Quantization for Video Enhancement
  18. QMambaBSR: Burst Image Super-Resolution with Query State Space Model
  19. RobustVisH: Robust Visual-Haptic Cross-Modal Recognition under Transmission Interference
  20. SIGMAN: Scaling 3D Human Gaussian Generation with Millions of Assets
  21. Towards Large-Scale In-Context Reinforcement Learning by Meta-Training in Randomized Worlds
  22. Towards Realistic Data Generation for Real-World Super-Resolution
  23. ViewPoint: Panoramic Video Generation with Pretrained Diffusion Models
  24. Bidirectional Progressive Transformer for Interaction Intention Anticipation
  25. EgoChoir: Capturing 3D Human-Object Interaction Regions from Egocentric Views
  26. Event-Based Eye Tracking. AIS 2024 Challenge Survey
  27. Hypercorrelation Evolution for Video Class-Incremental Learning
  28. LEMON: Learning 3D Human-Object Interaction Relation from 2D Images
  29. MambaPupil: Bidirectional Selective Recurrent model for Event-based Eye tracking
  30. Real-Time 4K Super-Resolution of Compressed AVIF Images. AIS 2024 Challenge Survey
  31. The Ninth NTIRE 2024 Efficient Super-Resolution Challenge Report