PPaperPicks

Yuke Zhu

27 papers at tracked venues · 12 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Learning from the Irrecoverable: Error-Localized Policy Optimization for Tool-Integrated LLM Reasoning
  2. Towards Interpretable Tabular Reasoning: Enhancing LLM Reasoning on Tabular Data with Pre-Constructed Logic Graph
  3. BUMBLE: Unifying Reasoning and Acting with Vision-Language Models for Building-wide Mobile Manipulation
  4. DexMimicGen: Automated Data Generation for Bimanual Dexterous Manipulation via Imitation Learning
  5. Enhancing Document Understanding with Group Position Embedding: A Novel Approach to Incorporate Layout Information
    ICLR 2025 · Yuke Zhu
  6. HOVER: Versatile Neural Whole-Body Controller for Humanoid Robots
  7. LightCity: An Urban Dataset for Outdoor Inverse Rendering and Reconstruction Under Multi-Illumination Conditions
  8. LongVILA: Scaling Long-Context Visual Language Models for Long Videos
  9. OmniKV: Dynamic Context Selection for Efficient Long-Context LLMs
  10. One-Step Diffusion Policy: Fast Visuomotor Policies via Diffusion Distillation
  11. PRESTO: Fast Motion Planning Using Diffusion Models Based on Key-Configuration Environment Representation
  12. RT-Affordance: Affordances are Versatile Intermediate Representations for Robot Manipulation
  13. SPOT: SE(3) Pose Trajectory Diffusion for Object-Centric Manipulation
  14. AMAGO-2: Breaking the Multi-Task Barrier in Meta-Reinforcement Learning with Transformers
  15. AMAGO: Scalable In-Context Reinforcement Learning for Adaptive Agents
  16. ARDuP: Active Region Video Diffusion for Universal Policies
  17. Building Minimal and Reusable Causal State Abstractions for Reinforcement Learning
  18. DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset
  19. Doduo: Learning Dense Visual Correspondence from Unsupervised Semantic-Aware Flow
  20. DrEureka: Language Model Guided Sim-To-Real Transfer
  21. Eureka: Human-Level Reward Design via Coding Large Language Models
  22. INTERPRET: Interactive Predicate Learning from Language Feedback for Generalizable Task Planning
  23. LOTUS: Continual Imitation Learning for Robot Manipulation Through Unsupervised Skill Discovery
  24. Model-Based Runtime Monitoring with Interactive Imitation Learning
  25. Open X-Embodiment: Robotic Learning Datasets and RT-X Models : Open X-Embodiment Collaboration
  26. PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs
  27. RoboCasa: Large-Scale Simulation of Household Tasks for Generalist Robots