PPaperPicks

Fu-En Yang

11 papers at tracked venues · 6 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Mitigating Object and Action Hallucinations in Multimodal LLMs via Self-Augmented Contrastive Alignment
  2. TA-Prompting: Enhancing Video Large Language Models for Dense Video Captioning via Temporal Anchors
  3. VADER: Towards Causal Video Anomaly Understanding with Relation-Aware Large Language Models
  4. LongSplat: Robust Unposed 3D Gaussian Splatting for Casual Long Videos
  5. MotionMatcher: Cinematic Motion Customization of Text-to-Video Diffusion Models via Motion Feature Matching
  6. ThinkAct: Vision-Language-Action Reasoning via Reinforced Visual Latent Planning
  7. VideoMage: Multi-Subject and Motion Customization of Text-to-Video Diffusion Models
  8. Language-Guided Transformer for Federated Multi-Label Classification
  9. RAPPER: Reinforced Rationale-Prompted Paradigm for Natural Language Explanation in Visual Question Answering
  10. Receler: Reliable Concept Erasing of Text-to-Image Diffusion Models via Lightweight Erasers
  11. Select and Distill: Selective Dual-Teacher Knowledge Transfer for Continual Learning on Vision-Language Models