PPaperPicks

Yezhou Yang

30 papers at tracked venues · 16 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Event-based Graph Representation with Spatial and Motion Vectors for Asynchronous Object Detection
  2. Improving Shape Bias in Learnable Geometric Moment Representations
  3. VOCAL: Visual Odometry via ContrAstive Learning
  4. eSkiTB: A Synthetic Event-Based Dataset for Tracking Skiers
  5. AcT2I: Evaluating and Improving Action Depiction in Text-to-Image Models
  6. Deep Geometric Moments Promote Shape Consistency in Text-to-3D Generation
  7. DeepShade: Enable Shade Simulation by Text-conditioned Image Generation
  8. EraseFlow: Learning Concept Erasure Policies via GFlowNet-Driven Alignment
  9. Event Quality Score (EQS): Assessing the Realism of Simulated Event Camera Streams via Distance in Latent Space
  10. FlowChef: Steering of Rectified Flow Models for Controlled Generations
  11. RefEdit: A Benchmark and Method for Improving Instruction-Based Image Editing Model on Referring Expressions
  12. Stable Cinemetrics : Structured Taxonomy and Evaluation for Professional Video Generation
  13. TextInVision: Text and Prompt Complexity Driven Visual Text Generation Benchmark
  14. VOILA: Evaluation of MLLMs For Perceptual Understanding and Analogical Reasoning
  15. 'Eyes of a Hawk and Ears of a Fox': Part Prototype Network for Generalized Zero-Shot Learning
  16. ConceptBed: Evaluating Concept Learning Abilities of Text-to-Image Diffusion Models
  17. ECLIPSE: A Resource-Efficient Text-to-Image Prior for Image Generations
  18. Evaluating Multimodal Large Language Models across Distribution Shifts and Augmentations
  19. Getting it Right: Improving Spatial Consistency in Text-to-Image Models
  20. Grounding Stylistic Domain Generalization with Quantitative Domain Shift Measures and Synthetic Scene Images
  21. Lost in Translation? Translation Errors and Challenges for Fair Assessment of Text-to-Image Models on Multilingual Concepts
  22. On the Robustness of Language Guidance for Low-Level Vision Tasks: Findings from Depth Estimation
  23. Precision or Recall? An Analysis of Image Captions for Training Text-to-Image Generation Model
  24. R.A.C.E. : Robust Adversarial Concept Erasure for Secure Text-to-Image Diffusion Model
  25. REVISION: Rendering Tools Enable Spatial Fidelity in Vision-Language Models
  26. Recent Event Camera Innovations: A Survey
  27. TROPE: TRaining-Free Object-Part Enhancement for Seamlessly Improving Fine-Grained Zero-Shot Image Captioning
  28. TripletCLIP: Improving Compositional Reasoning of CLIP via Synthetic Vision-Language Negatives
  29. WOUAF: Weight Modulation for User Attribution and Fingerprinting in Text-to-Image Diffusion Models
  30. eTraM: Event-Based Traffic Monitoring Dataset