PPaperPicks

Xinyu Zhao

26 papers at tracked venues · 16 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Demystify the Role of Memory in Machine Learning Engineering Agents
    ACL 2026 · Xinyu Zhao
  2. Dialogue is Better Than Monologue: Instructing Meidcal LLMs via Strategic Conversations
  3. Learning Flexible Large Multimodal Models with Arbitrary Modality Combinations
    ACL 2026 · Xinyu Zhao
  4. Metacognitive Self-Correction for Multi-Agent System via Prototype-Guided Next-Execution Reconstruction
  5. Two Heads Are Better than One: Distilling Large Language Model Features into Small Models with Feature Decomposition and Mixture
  6. Vulnerability-Aware Robust Multimodal Adversarial Training
  7. Bit-Flip Error Resilience in LLMs: A Comprehensive Analysis and Defense Framework
  8. BrainMAP: Learning Multiple Activation Pathways in Brain Networks
  9. CTSG: Integrating Context and Way Topology Into Scene Graph for Zero-shot Navigation
  10. ChartMuseum: Testing Visual Reasoning Capabilities of Large Vision-Language Models
  11. Convex Combination Star Shape Prior for Data-driven Image Semantic Segmentation
    CVPR 2025 · Xinyu Zhao
  12. GraphRCG: Self-Conditioned Graph Generation
  13. GuideLLM: Exploring LLM-Guided Conversation with Applications in Autobiography Interviewing
  14. SABPI-Net: A Novel Structure-Aware Network for Accurate and Domain-Invariant Retinopathy of Prematurity Diagnosis
  15. Task-Aware Resolution Optimization for Visual Large Language Models
  16. To CoT or not to CoT? Chain-of-thought helps mainly on math and symbolic reasoning
  17. Towards Stabilized and Efficient Diffusion Transformers Through Long-Skip-Connections With Spectral Constraints
  18. UQ-Merge: Uncertainty Guided Multimodal Large Language Model Merging
  19. Understanding Synthetic Context Extension via Retrieval Heads
    ICML 2025 · Xinyu Zhao
  20. Enhancing Baidu Multimodal Advertisement with Chinese Text-to-Image Generation via Bilingual Alignment and Caption Synthesis
  21. Learning to Refine with Fine-Grained Natural Language Feedback
  22. MoE-RBench: Towards Building Reliable Language Models with Sparse Mixture-of-Experts
  23. Model-GLUE: Democratized LLM Scaling for A Large Model Zoo in the Wild
    NeurIPS 2024 · Xinyu Zhao
  24. Multi-Stage Refined Visual Captioning for Baidu Ad Creatives Generation
  25. Scaling Vison-Language Foundation Model to 12 Billion Parameters in Baidu Dynamic Image Advertising
    CIKM 2024 · Xinyu Zhao
  26. Sparse MoE with Language Guided Routing for Multilingual Machine Translation
    ICLR 2024 · Xinyu Zhao