PPaperPicks

Ruiyi Zhang

Adobe Research, San Jose, CA, USA

29 papers at tracked venues · 19 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. A Survey on LLM-based Conversational User Simulation
  2. CachePrune: Teaching LLMs What Not to Follow via KV-Cache Editing
  3. Decomposition-Enhanced Training for Post-Hoc Attributions in Language Models
  4. Lizard: An Efficient Linearization Framework for Large Language Models
  5. OIDA-QA: A Multimodal Benchmark for Analyzing the Opioid Industry Documents Archive
  6. Unveiling Inherent Visual Grounding in Multimodal LLMs for Text-Rich Images
  7. VipAct: Visual-Perception Enhancement via Specialized VLM Agent Collaboration and Tool-use
  8. Vision Language Models Learn to Assess Images with Specialists
  9. A Survey on Long-Video Storytelling Generation: Architectures, Consistency, and Cinematic Quality
  10. ARTIST: Improving the Generation of Text-Rich Images with Disentangled Diffusion Models and Large Language Models
  11. Doc-React: Multi-page Heterogeneous Document Question-answering
  12. From Selection to Generation: A Survey of LLM-based Active Learning
  13. GUI Agents: A Survey
  14. GUI-Bee: Align GUI Action Grounding to Novel Environments via Autonomous Exploration
  15. Multimodal LLMs as Customized Reward Models for Text-to-Image Generation
  16. Numerical Pruning for Efficient Autoregressive Models
  17. Personalizing Data Delivery: Investigating User Characteristics and Enhancing LLM Predictions
  18. SV-RAG: LoRA-Contextualizing Adaptation of MLLMs for Long Document Understanding
  19. Self-Debiasing Large Language Models: Zero-Shot Recognition and Reduction of Stereotypes
  20. ADOPD: A Large-Scale Document Page Decomposition Dataset
  21. Customization Assistant for Text-to-image Generation
  22. Knowledge Graph Prompting for Multi-Document Question Answering
  23. Personalized Federated Learning for Text Classification with Gradient-Free Prompt Tuning
  24. SOHES: Self-supervised Open-world Hierarchical Entity Segmentation
  25. Self-Cleaning: Improving a Named Entity Recognizer Trained on Noisy Data with a Few Clean Instances
  26. TRINS: Towards Multimodal Language Models that Can Read
    CVPR 2024 · Ruiyi Zhang
  27. TextLap: Customizing Language Models for Text-to-Layout Planning
  28. Topology-aware Retrieval Augmentation for Text Generation
  29. Towards Aligned Layout Generation via Diffusion Model with Aesthetic Constraints