PPaperPicks

Lifu Huang

43 papers at tracked venues · 24 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Endowing Vision-Language Models with System 2 Thinking for Fine-grained Visual Recognition
  2. From Passive Metric to Active Signal: The Evolving Role of Uncertainty Quantification in Large Language Models
  3. From Vulnerable to Resilient: Examining Parent and Teen Perceptions on How to Respond to Unwanted Cybergrooming Advances
  4. AAAR-1.0: Assessing AI's Potential to Assist Research
  5. AR-RAG: Autoregressive Retrieval Augmentation for Image Generation
  6. Advancing Chart Question Answering with Robust Chart Component Recognition
  7. All You Need is One: Capsule Prompt Tuning with a Single Vector
  8. DiPT: Enhancing LLM Reasoning through Diversified Perspective-Taking
  9. Error-driven Data-efficient Large Multimodal Model Tuning
  10. Grounded-VideoLLM: Sharpening Fine-grained Temporal Grounding in Video Large Language Models
  11. Inference Compute-Optimal Video Vision Language Models
  12. LLM Braces: Straightening Out LLM Predictions with Relevant Sub-Updates
  13. LLMs Can Reason Faster Only If We Let Them
  14. MEPT: Mixture of Expert Prompt Tuning as a Manifold Mapper
  15. MetaScientist: A Human-AI Synergistic Framework for Automated Mechanical Metamaterial Design
  16. MetamatBench: Integrating Heterogeneous Data, Computational Tools, and Visual Interface for Metamaterial Discovery
  17. Modality-Specialized Synergizers for Interleaved Vision-Language Generalists
  18. Persona-SQ: A Personalized Suggested Question Generation Framework For Real-world Documents
  19. Probabilistic Token Alignment for Large Language Model Fusion
  20. R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation
  21. Re-Imagining Multimodal Instruction Tuning: A Representation View
  22. SPARTUN3D: Situated Spatial Understanding of 3D World in Large Language Model
  23. Sycophancy Mitigation Through Reinforcement Learning with Uncertainty-Aware Adaptive Reasoning Trajectories
  24. Towards Agentic AI for Science: Hypothesis Generation, Comprehension, Quantification, and Validation
    WWW 2025 · Lifu Huang
  25. UniHGKR: Unified Instruction-aware Heterogeneous Knowledge Retrievers
  26. AMD: Automatic Multi-step Distillation of Large-Scale Vision Models
  27. DA-Code: Agent Data Science Code Generation Benchmark for Large Language Models
  28. Debate as Optimization: Adaptive Conformal Prediction and Diverse Retrieval for Event Extraction
  29. EAVE: Efficient Product Attribute Value Extraction via Lightweight Sparse-layer Interaction
  30. Facing the Elephant in the Room: Visual Prompt Tuning or Full finetuning?
  31. Holistic Evaluation for Interleaved Text-and-Image Generation
  32. InternalInspector I²: Robust Confidence Estimation in LLMs through Internal States
  33. MULTISCRIPT: Multimodal Script Learning for Supporting Open Domain Everyday Tasks
  34. Multimodal Instruction Tuning with Conditional Mixture of LoRA
  35. M²PT: Multimodal Prompt Tuning for Zero-shot Instruction Learning
  36. Navigating the Dual Facets: A Comprehensive Evaluation of Sequential Memory Editing in Large Language Models
  37. Position: TrustLLM: Trustworthiness in Large Language Models
  38. RE²: Region-Aware Relation Extraction from Visually Rich Documents
  39. Targeted Augmentation for Low-Resource Event Extraction
  40. Vision-Flan: Scaling Human-Labeled Tasks in Visual Instruction Tuning
  41. Visual Fourier Prompt Tuning
  42. X-Eval: Generalizable Multi-aspect Text Evaluation via Augmented Instruction Tuning with Auxiliary Evaluation Aspects
  43. X-Shot: A Unified System to Handle Frequent, Few-shot and Zero-shot Learning Simultaneously in Classification