PPaperPicks

Qifan Wang

Meta AI, Menlo Park, CA, USA

67 papers at tracked venues · 44 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Bringing Reasoning to Generative Recommendation Through the Lens of Cascaded Ranking
  2. Chain-of-Search: Parameter-Efficient Reasoning for Zero-Shot Object Navigation
  3. On-the-Fly VLA Adaptation via Test-Time Reinforcement Learning
  4. Quantize What Counts: More for Keys, Less for Values
  5. RecoWorld: Building Simulated Environments for Agentic Recommender Systems
  6. TROJail: Trajectory-Level Optimization for Multi-Turn Large Language Model Jailbreaks with Process Rewards
  7. Verifiable Reasoning for LLM-based Generative Recommendation
  8. 100-LongBench: Are de facto Long-Context Benchmarks Literally Evaluating Long-Context Ability?
  9. AR-RAG: Autoregressive Retrieval Augmentation for Image Generation
  10. Advantage-Guided Distillation for Preference Alignment in Small Language Models
  11. Agentic Feedback Loop Modeling Improves Recommendation and User Simulation
  12. All You Need is One: Capsule Prompt Tuning with a Single Vector
  13. Assistant-Guided Mitigation of Teacher Preference Bias in LLM-as-a-Judge
  14. CompCap: Improving Multimodal Large Language Models with Composite Captions
  15. CrAM: Credibility-Aware Attention Modification in LLMs for Combating Misinformation in RAG
  16. Dynamic Fisher-weighted Model Merging via Bayesian Optimization
  17. Error-driven Data-efficient Large Multimodal Model Tuning
  18. Exploring the Adversarial Vulnerabilities of Vision-Language-Action Models in Robotics
  19. FinHEAR: Human Expertise and Adaptive Risk-Aware Temporal Reasoning for Financial Decision-Making
  20. Grounded-VideoLLM: Sharpening Fine-grained Temporal Grounding in Video Large Language Models
  21. IDInit: A Universal and Stable Initialization Method for Neural Network Training
  22. Inference Compute-Optimal Video Vision Language Models
  23. K-order Ranking Preference Optimization for Large Language Models
  24. MEPT: Mixture of Expert Prompt Tuning as a Manifold Mapper
  25. Modality-Specialized Synergizers for Interleaved Vision-Language Generalists
  26. NEXUS-O: An Omni-Perceptive and -Interactive Model for Language, Audio, and Vision
  27. On the Power of Adaptive Weighted Aggregation in Heterogeneous Federated Learning and Beyond
  28. Optimizing Recall or Relevance? A Multi-Task Multi-Head Approach for Item-to-Item Retrieval in Recommendation
  29. Order-agnostic Identifier for Large Language Model-based Generative Recommendation
  30. Probabilistic Token Alignment for Large Language Model Fusion
  31. Re-Imagining Multimodal Instruction Tuning: A Representation View
  32. ReAlign: Structured Revision for Small Language Model Alignment
  33. STaR: Multi-Granular Spatio-Temporal Reasoning for Long-Form Dense Video Captioning
  34. Sycophancy Mitigation Through Reinforcement Learning with Uncertainty-Aware Adaptive Reasoning Trajectories
  35. Uncertainty Quantification for Multiple-Choice Questions is Just One-Token Deep
  36. Visual Agents as Fast and Slow Thinkers
  37. When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations
  38. A Single Vector Is Not Enough: Taxonomy Expansion via Box Embeddings (Extended Abstract)
  39. AMD: Automatic Multi-step Distillation of Large-Scale Vision Models
  40. C-ICL: Contrastive In-context Learning for Information Extraction
  41. Direct Multi-Turn Preference Optimization for Language Agents
  42. EAVE: Efficient Product Attribute Value Extraction via Lightweight Sparse-layer Interaction
  43. FFB: A Fair Fairness Benchmark for In-Processing Group Fairness Methods
  44. Facing the Elephant in the Room: Visual Prompt Tuning or Full finetuning?
  45. HYDRA: Model Factorization Framework for Black-Box LLM Personalization
  46. Image Translation as Diffusion Visual Programmers
  47. InternalInspector I²: Robust Confidence Estimation in LLMs through Internal States
  48. Jack of All Tasks, Master of Many: Designing General-purpose Coarse-to-Fine Vision-Language Model
  49. LLM-Rec: Personalized Recommendation via Prompting Large Language Models
  50. LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models
  51. Large Language Models are Learnable Planners for Long-Term Recommendation
  52. MART: Improving LLM Safety with Multi-round Automatic Red-Teaming
  53. MCL-NER: Cross-Lingual Named Entity Recognition via Multi-View Contrastive Learning
  54. Multimodal Instruction Tuning with Conditional Mixture of LoRA
  55. M²PT: Multimodal Prompt Tuning for Zero-shot Instruction Learning
  56. Navigating the Dual Facets: A Comprehensive Evaluation of Sequential Memory Editing in Large Language Models
  57. ProMotion: Prototypes as Motion Learners
  58. Prototypical Transformer As Unified Motion Learners
  59. RESPROMPT: Residual Connection Prompting Advances Multi-Step Reasoning in Large Language Models
  60. Radiance Field Learners As UAV First-Person Viewers
  61. Representation Deficiency in Masked Language Modeling
  62. Speculative Decoding via Early-exiting for Faster LLM Inference with Thompson Sampling Control Mechanism
  63. Think Twice Before Trusting: Self-Detection for Large Language Models through Comprehensive Answer Reflection
  64. Unveiling User Satisfaction and Creator Productivity Trade-Offs in Recommendation Platforms
  65. User Welfare Optimization in Recommender Systems with Competing Content Creators
  66. Vision-Flan: Scaling Human-Labeled Tasks in Visual Instruction Tuning
  67. Visual Fourier Prompt Tuning