PPaperPicks

Yifan Zhang

National University of Singapore

26 papers at tracked venues · 20 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. DriveFlow: Rectified Flow Adaptation for Robust 3D Object Detection in Autonomous Driving
  2. ErrorRadar: Benchmarking Complex Mathematical Reasoning of Multimodal Large Language Models Via Error Detection
  3. Scaling Law for Multimodal Large Language Model Supervised Fine-Tuning
    ACL 2026 · Yifan Zhang
  4. Why Can Distillation Work with Limited Resources? A Systematic Study
  5. A Comprehensive Evaluation on Event Reasoning of Large Language Models
  6. AI-Driven Virtual Teacher for Enhanced Educational Efficiency: Leveraging Large Pretrain Models for Autonomous Error Analysis and Correction
  7. Beyond Isolated Words: Diffusion Brush for Handwritten Text-Line Generation
  8. DAMA: Data- and Model-aware Alignment of Multi-modal LLMs
  9. Debiasing Multimodal Large Language Models via Penalization of Language Priors
    ACM MM 2025 · Yifan Zhang
  10. DriveGEN: Generalized and Robust 3D Detection in Driving via Controllable Text-to-Image Diffusion Generation
  11. Finite State Automata Inside Transformers with Chain-of-Thought: A Mechanistic Study on State Tracking
    ACL 2025 · Yifan Zhang
  12. Learning to Extrapolate and Adjust: Two-Stage Meta-Learning for Concept Drift in Online Time Series Forecasting
  13. MEGA: Memory-Efficient 4D Gaussian Splatting for Dynamic Scenes
  14. MM-RLHF: The Next Step Forward in Multimodal LLM Alignment
    ICML 2025 · Yifan Zhang
  15. MME-RealWorld: Could Your Multimodal LLM Challenge High-Resolution Real-World Scenarios that are Difficult for Humans?
    ICLR 2025 · Yifan Zhang
  16. MME-VideoOCR: Evaluating OCR-Based Capabilities of Multimodal LLMs in Video Scenarios
  17. MemeReaCon: Probing Contextual Meme Understanding in Large Vision-Language Models
  18. Poison-splat: Computation Cost Attack on 3D Gaussian Splatting
  19. VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech Interaction
  20. VLM as Policy: Common-Law Content Moderation Framework for Short Video Platform
  21. A Study on the Calibration of In-context Learning
  22. Evaluating Step-by-Step Reasoning through Symbolic Verification
    NAACL 2024 · Yifan Zhang
  23. From Question to Exploration: Can Classic Test-Time Adaptation Strategies Be Effectively Applied in Semantic Segmentation?
  24. MonoTTA: Fully Test-Time Adaptation for Monocular 3D Object Detection
  25. One-DM: One-Shot Diffusion Mimicker for Handwritten Text Generation
  26. Position: What Can Large Language Models Tell Us about Time Series Analysis