PPaperPicks

Furong Huang

University of Maryland, College Park, USA

59 papers at tracked venues · 47 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AdvBDGen: A Robust Framework for Generating Adaptive and Stealthy Backdoors in LLM Alignment
  2. EnsemW2S: Enhancing Weak-to-Strong Generalization with Large Language Model Ensembles
  3. Jailbreaks as Inference-Time Alignment: A Framework for Understanding Safety Failures in LLMs
  4. Teach a Reward Model to Correct Itself: Reward Guided Adversarial Failure Discovery for Robust Reward Modeling
    ACL 2026 ·
    Pankayaraj Pathmanathan
  5. Towards Mitigating Hallucinations in Large Vision-Language Models by Refining Textual Embeddings
  6. A Technical Report on "Erasing the Invisible": The 2024 NeurIPS Competition on Stress Testing Image Watermarks
  7. Benchmarking Vision Language Model Unlearning via Fictitious Facial Identity Dataset
  8. CSRec: Rethinking Sequential Recommendation from A Causal Perspective
  9. Can Watermarking Large Language Models Prevent Copyrighted Text Generation and Hide Training Data?
    AAAI 2025 ·
    Michael-Andrei Panaitescu-Liess
  10. Collab: Controlled Decoding using Mixture of Agents for LLM Alignment
  11. DISCO Balances the Scales: Adaptive Domain- and Difficulty-Aware Reinforcement Learning on Imbalanced Data
  12. Does Thinking More Always Help? Mirage of Test-Time Scaling in Reasoning Models
  13. Enhancing Visual-Language Modality Alignment in Large Vision Language Models via Self-Improvement
  14. GenARM: Reward Guided Generation with Autoregressive Reward Model for Test-Time Alignment
  15. GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning
  16. Immune: Improving Safety Against Jailbreaks in Multi-modal LLMs via Inference-Time Alignment
  17. Is Poisoning a Real Threat to DPO? Maybe More So Than You Think
  18. Large Language Models and Causal Inference in Collaboration: A Comprehensive Survey
  19. MergeME: Model Merging Techniques for Homogeneous and Heterogeneous MoEs
  20. PoisonedParrot: Subtle Data Poisoning Attacks to Elicit Copyright-Infringing Content from Large Language Models
    NAACL 2025 ·
    Michael-Andrei Panaitescu-Liess
  21. Safety Guaranteed Robust Multi-Agent Reinforcement Learning with Hierarchical Control for Connected and Automated Vehicles
  22. Scaling Inference-Time Search with Vision Value Model for Improved Visual Comprehension
  23. SoTA with Less: MCTS-Guided Sample Selection for Data-Efficient Visual Reasoning Self-Improvement
  24. Statistical Guarantees for Lifelong Reinforcement Learning using PAC-Bayes Theory
  25. TraceVLA: Visual Trace Prompting Enhances Spatial-Temporal Awareness for Generalist Robotic Policies
  26. Uncertainty-Aware Answer Selection for Improved Reasoning in Multi-LLM Systems
  27. ViCrit: A Verifiable Reinforcement Learning Proxy Task for Visual Perception in VLMs
  28. World Models with Hints of Large Language Models for Goal Achieving
  29. Zero-Shot Vision Encoder Grafting via LLM Surrogates
  30. A Linear Time and Space Local Point Cloud Geometry Encoder via Vectorized Kernel Mixture (VecKM)
  31. ACE: Off-Policy Actor-Critic with Causality-Aware Entropy Regularization
  32. Adapting Static Fairness to Sequential Decision-Making: Bias Mitigation Strategies towards Equal Long-term Benefit Rate
  33. AutoHallusion: Automatic Generation of Hallucination Benchmarks for Vision-Language Models
  34. Beyond Worst-case Attacks: Robust RL with Adaptive Defense via Non-dominated Policies
  35. Boosting Sample Efficiency and Generalization in Multi-agent Reinforcement Learning via Equivariance
  36. COPlanner: Plan to Roll Out Conservatively but to Explore Optimistically for Model-Based RL
  37. Decodable and Sample Invariant Continuous Object Encoder
  38. DrM: Mastering Visual Reinforcement Learning through Dormant Ratio Minimization
  39. Easy2Hard-Bench: Standardized Difficulty Labels for Profiling LLM Performance and Generalization
  40. Explore Spurious Correlations at the Concept Level in Language Models for Text Classification
  41. FACT or Fiction: Can Truthful Mechanisms Eliminate Federated Free Riding?
  42. Game-Theoretic Robust Reinforcement Learning Handles Temporally-Coupled Perturbations
  43. Hallusionbench: An Advanced Diagnostic Suite for Entangled Language Hallucination and Visual Illusion in Large Vision-Language Models
  44. Like Oil and Water: Group Robustness Methods and Poisoning Defenses May Be at Odds
    ICLR 2024 ·
    Michael-Andrei Panaitescu-Liess
  45. Make-An-Agent: A Generalizable Policy Network Generator with Behavior-Prompted Diffusion
  46. MaxMin-RLHF: Alignment with Diverse Human Preferences
  47. Mementos: A Comprehensive Benchmark for Multimodal Large Language Model Reasoning over Image Sequences
  48. Multi-Stage Balanced Distillation: Addressing Long-Tail Challenges in Sequence-Level Knowledge Distillation
  49. PARL: A Unified Framework for Policy Alignment in Reinforcement Learning from Human Feedback
  50. PRISE: LLM-Style Sequence Compression for Learning Temporal Action Abstractions in Control
  51. PerceptionCLIP: Visual Classification by Inferring and Conditioning on Contexts
  52. Position: On the Possibilities of AI-Generated Text Detection
  53. Position: TrustLLM: Trustworthiness in Large Language Models
  54. Premier-TACO is a Few-Shot Policy Learner: Pretraining Multitask Representation via Temporal Action-Driven Contrastive Loss
  55. Rethinking Adversarial Policies: A Generalized Attack Formulation and Provable Defense in RL
  56. SAFLEX: Self-Adaptive Augmentation via Feature Label Extrapolation
  57. Shadowcast: Stealthy Data Poisoning Attacks Against Vision-Language Models
  58. Transfer Q-star : Principled Decoding for LLM Alignment
  59. WAVES: Benchmarking the Robustness of Image Watermarks