PPaperPicks

Lanqing Hong

27 papers at tracked venues · 19 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AEQ-Bench: Measuring Empathy of Omni-Modal Large Models
  2. Empowering Sparse-Input Neural Radiance Fields with Dual-Level Semantic Guidance from Dense Novel Views
  3. MagicDrive3D: Controllable 3D Generation for Any-View Rendering in Street Scenes
  4. Multi-Faceted Attack: Exposing Cross-Model Vulnerabilities in Defense-Equipped Vision-Language Models
  5. Automated Evaluation of Large Vision-Language Models on Self-Driving Corner Cases
  6. Certifying Language Model Robustness with Fuzzed Randomized Smoothing: An Efficient Defense Against Backdoor Attacks
  7. Corrupted but Not Broken: Understanding and Mitigating the Negative Impacts of Corrupted Data in Visual Instruction Tuning
  8. EMOVA: Empowering Language Models to See, Hear and Speak with Vivid Emotions
  9. G-LLaVA: Solving Geometric Problem with Multi-Modal Large Language Model
  10. Getting More Juice Out of Your Data: Hard Pair Refinement Enhances Visual-Language Models Without Extra Data
  11. MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control
  12. Mixture of insighTful Experts (MoTE): The Synergy of Reasoning Chains and Expert Mixtures in Self-Alignment
  13. Self-Error-Instruct: Generalizing from Errors for LLMs Mathematical Reasoning
  14. SplatMesh: Interactive 3D Segmentation and Editing Using Mesh-Based Gaussian Splatting
  15. Taming Video Diffusion Prior with Scene-Grounding Guidance for 3D Gaussian Splatting from Sparse Inputs
  16. TrackDiffusion: Tracklet-Conditioned Video Generation via Diffusion Models
  17. CVT-xRF: Contrastive In-Voxel Transformer for 3D Consistent Radiance Fields from Sparse Inputs
  18. CoSafe: Evaluating Large Language Model Safety in Multi-Turn Dialogue Coreference
  19. DetDiffusion: Synergizing Generative and Perceptive Models for Enhanced Data Generation and Perception
  20. Dual Risk Minimization: Towards Next-Level Robustness in Fine-tuning Zero-Shot Models
  21. Eyes Closed, Safety on: Protecting Multimodal LLMs via Image-to-Text Transformation
  22. G-NAS: Generalizable Neural Architecture Search for Single Domain Generalization Object Detection
  23. Gaining Wisdom from Setbacks: Aligning Large Language Models via Mistake Analysis
  24. GeoDiffusion: Text-Prompted Geometric Control for Object Detection Data Generation
  25. Implicit Concept Removal of Diffusion Models
  26. LLMs Can Evolve Continually on Modality for X-Modal Reasoning
  27. MagicDrive: Street View Generation with Diverse 3D Geometry Control