PPaperPicks

Houqiang Li

University of Science and Technology of China, Department of Electrical Engineering and Information Science, Hefei, China

53 papers at tracked venues · 46 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Bias Fitting to Mitigate Length Bias of Reward Model in RLHF
  2. CodeContests-O: Powering LLMs via Feedback-Driven Iterative Test Case Generation
  3. DocR1: Evidence Page-Guided GRPO for Multi-Page Document Understanding
  4. Exploration-Exploitation Reshaping towards Efficient Reasoning for Large Language Models
  5. Rethinking Long-tailed Dataset Distillation: A Uni-Level Framework with Unbiased Recovery and Relabeling
  6. SGA-MCTS: Decoupling Planning from Execution via Training-Free Atomic Experience Retrieval
  7. Active Perception Meets Rule-Guided RL: A Two-Phase Approach for Precise Object Navigation in Complex Environments
  8. Adaptive Confidence-aware Preference-based Reinforcement Learning with Noisy Feedback
  9. Controllable Style Arithmetic with Language Models
  10. Cross-Modal Consistency Learning for Sign Language Recognition
  11. DP-Habitat: Bridging the Gap Between Simulation and Reality for Visual Navigation in Dynamic Pedestrian Environments
  12. Deep Video Discovery: Agentic Search with Tool Use for Long-form Video Understanding
  13. DesignDiffusion: High-Quality Text-to-Design Image Generation with Diffusion Models
  14. Detector-free Image Matching with Lightweight Backbone and Feature Filtering
  15. EG4D: Explicit Generation of 4D Object without Score Distillation
  16. Enhancing the Outcome Reward-based RL Training of MLLMs with Self-Consistency Sampling
  17. Interpret and Improve In-Context Learning via the Lens of Input-Label Mappings
  18. Make-It-Animatable: An Efficient Framework for Authoring Animation-Ready 3D Characters
  19. Mitigating Hallucination in VideoLLMs via Temporal-Aware Activation Engineering
  20. Multi-Level Optimal Transport for Universal Cross-Tokenizer Knowledge Distillation on Language Models
  21. OPTICAL: Leveraging Optimal Transport for Contribution Allocation in Dataset Distillation
  22. Optimizing Distributional Geometry Alignment with Optimal Transport for Generative Dataset Distillation
  23. RaCFormer: Towards High-Quality 3D Object Detection via Query-based Radar-Camera Fusion
  24. Robust Multimodal Large Language Models Against Modality Conflict
  25. S3R-GS: Streamlining the Pipeline for Large-Scale Street Scene Reconstruction
  26. SLRTP2025 Sign Language Production Challenge: Methodology, Results and Future Work
  27. Self-Classification Enhancement and Correction for Weakly Supervised Object Detection
  28. SmartEraser: Remove Anything from Images using Masked-Region Guidance
  29. TinySAM: Pushing the Envelope for Efficient Segment Anything Model
  30. Towards Practical Real-Time Neural Video Compression
  31. Uni-Sign: Toward Unified Sign Language Understanding at Scale
  32. Visual Evidence Prompting Mitigates Hallucinations in Large Vision-Language Models
  33. BoolQuestions: Does Dense Retrieval Understand Boolean Logic in Language?
  34. Exploring GPT-4 Vision for Text-to-Image Synthesis Evaluation
  35. FOREST2SEQ: Revitalizing Order Prior for Sequential Indoor Scene Synthesis
  36. Fact Embedding through Diffusion Model for Knowledge Graph Completion
  37. From Yes-Men to Truth-Tellers: Addressing Sycophancy in Large Language Models with Pinpoint Tuning
  38. Generative Latent Coding for Ultra-Low Bitrate Image Compression
  39. Heredity-aware Child Face Image Generation with Latent Space Disentanglement
  40. Image2Sentence based Asymmetrical Zero-shot Composed Image Retrieval
  41. Instance-Aware Exploration-Verification-Exploitation for Instance ImageGoal Navigation
  42. InstructDiffusion: A Generalist Modeling Interface for Vision Tasks
  43. Interpretable Composition Attribution Enhancement for Visio-linguistic Compositional Understanding
  44. KGDM: A Diffusion Model to Capture Multiple Relation Semantics for Knowledge Graph Embedding
  45. Learning Label Dependencies for Visual Information Extraction
  46. Long-Term Temporal Context Gathering for Neural Video Compression
  47. P-RAG: Progressive Retrieval Augmented Generation For Planning on Embodied Everyday Task
  48. Revisiting Open-Set Panoptic Segmentation
  49. SEDS: Semantically Enhanced Dual-Stream Encoder for Sign Language Retrieval
  50. SUF: Stabilized Unconstrained Fine-Tuning for Offline-to-Online Reinforcement Learning
  51. Semi-Supervised Spoken Language Glossification
  52. TabPedia: Towards Comprehensive Visual Table Understanding with Concept Synergy
  53. Trustworthy Alignment of Retrieval-Augmented Large Language Models via Reinforcement Learning