PPaperPicks

Linjiang Huang

13 papers at tracked venues · 12 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. MathCanvas: Intrinsic Visual Chain-of-Thought for Multimodal Mathematical Reasoning
  2. VaccineRAG: Boosting Multimodal Large Language Models' Immunity to Harmful RAG Samples
  3. 'Hi AirStar, Guide Me to the Badminton Court.'
  4. AeroDuo: Aerial Duo for UAV-based Vision and Language Navigation
  5. DSACap: Enhancing Visual-Semantic Alignment with Diffusion-based Framework for Image Captioning
  6. FlexDrive: Toward Trajectory Flexibility in Driving Scene Gaussian Splatting Reconstruction and Rendering
  7. FreeDNA: Endowing Domain Adaptation of Diffusion-Based Dense Prediction with Training-Free Domain Noise Alignment
  8. GaussianPainter: Painting Point Cloud into 3D Gaussians with Normal Guidance
  9. GoT: Unleashing Reasoning Capability of MLLM for Visual Generation and Editing
  10. NopeRoomGS: Indoor 3D Gaussian Splatting Optimization without Camera Pose Input
  11. PUMA: Empowering Unified MLLM with Multi-Granular Visual Generation
  12. SOLVE: Synergy of Language-Vision and End-to-End Networks for Autonomous Driving
  13. FouriScale: A Frequency Perspective on Training-Free High-Resolution Image Synthesis
    ECCV 2024 · Linjiang Huang