PPaperPicks

Wengang Zhou

University of Science and Technology of China, Department of Electronic Engineering and Information Science, MCC Lab, Hefei, China

42 papers at tracked venues · 38 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Bias Fitting to Mitigate Length Bias of Reward Model in RLHF
  2. CodeContests-O: Powering LLMs via Feedback-Driven Iterative Test Case Generation
  3. DocR1: Evidence Page-Guided GRPO for Multi-Page Document Understanding
  4. Exploration-Exploitation Reshaping towards Efficient Reasoning for Large Language Models
  5. Rethinking Long-tailed Dataset Distillation: A Uni-Level Framework with Unbiased Recovery and Relabeling
  6. SGA-MCTS: Decoupling Planning from Execution via Training-Free Atomic Experience Retrieval
  7. Active Perception Meets Rule-Guided RL: A Two-Phase Approach for Precise Object Navigation in Complex Environments
  8. Adaptive Confidence-aware Preference-based Reinforcement Learning with Noisy Feedback
  9. Aligning Global Semantics and Local Textures in Generative Video Enhancement
  10. Controllable Style Arithmetic with Language Models
  11. Cross-Modal Consistency Learning for Sign Language Recognition
  12. DP-Habitat: Bridging the Gap Between Simulation and Reality for Visual Navigation in Dynamic Pedestrian Environments
  13. DesignDiffusion: High-Quality Text-to-Design Image Generation with Diffusion Models
  14. Detector-free Image Matching with Lightweight Backbone and Feature Filtering
  15. EG4D: Explicit Generation of 4D Object without Score Distillation
  16. Enhancing the Outcome Reward-based RL Training of MLLMs with Self-Consistency Sampling
  17. I2VGuard: Safeguarding Images against Misuse in Diffusion-based Image-to-Video Models
  18. Image as a World: Generating Interactive World from Single Image via Panoramic Video Generation
  19. Make-It-Animatable: An Efficient Framework for Authoring Animation-Ready 3D Characters
  20. Mitigating Hallucination in VideoLLMs via Temporal-Aware Activation Engineering
  21. Multi-Level Optimal Transport for Universal Cross-Tokenizer Knowledge Distillation on Language Models
  22. OPTICAL: Leveraging Optimal Transport for Contribution Allocation in Dataset Distillation
  23. Optimizing Distributional Geometry Alignment with Optimal Transport for Generative Dataset Distillation
  24. Robust Multimodal Large Language Models Against Modality Conflict
  25. SLRTP2025 Sign Language Production Challenge: Methodology, Results and Future Work
  26. Self-Classification Enhancement and Correction for Weakly Supervised Object Detection
  27. SmartEraser: Remove Anything from Images using Masked-Region Guidance
  28. Uni-Sign: Toward Unified Sign Language Understanding at Scale
  29. BoolQuestions: Does Dense Retrieval Understand Boolean Logic in Language?
  30. Exploring GPT-4 Vision for Text-to-Image Synthesis Evaluation
  31. FOREST2SEQ: Revitalizing Order Prior for Sequential Indoor Scene Synthesis
  32. Heredity-aware Child Face Image Generation with Latent Space Disentanglement
  33. Image2Sentence based Asymmetrical Zero-shot Composed Image Retrieval
  34. Instance-Aware Exploration-Verification-Exploitation for Instance ImageGoal Navigation
  35. Learning Spatial Adaptation and Temporal Coherence in Diffusion Models for Video Super-Resolution
  36. P-RAG: Progressive Retrieval Augmented Generation For Planning on Embodied Everyday Task
  37. Revisiting Open-Set Panoptic Segmentation
  38. SEDS: Semantically Enhanced Dual-Stream Encoder for Sign Language Retrieval
  39. SUF: Stabilized Unconstrained Fine-Tuning for Offline-to-Online Reinforcement Learning
  40. Semi-Supervised Spoken Language Glossification
  41. TabPedia: Towards Comprehensive Visual Table Understanding with Concept Synergy
  42. Trustworthy Alignment of Retrieval-Augmented Large Language Models via Reinforcement Learning