PPaperPicks

Weiming Lu

Zhejiang University, College of Computer Science and Technology, China

40 papers at tracked venues · 31 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AutoTaskEval: Towards Domain-Specific and Fine-Grained Evaluation for LLMs
  2. CoVerRL: Breaking the Consensus Trap in Label-Free Reasoning via Generator-Verifier Co-Evolution
  3. Embodied-Reasoner: Synergizing Visual Search, Reasoning, and Action for Embodied Interactive Tasks
  4. Experience-driven Multi-turn Reinforcement Learning for GUI Agents
  5. GUI-G²: Gaussian Reward Modeling for GUI Grounding
  6. Leveraging Outline-Optimized Generative Interactions and Critique for Self-Refining Outlines with Reinforcement Learning
  7. Pause or Fabricate? Training Language Models for Grounded Reasoning
  8. Phun-Bench: Evaluating LLMs on Phonological Understanding in Chinese
  9. Reality vs Counterfactual: Multi-World Contrastive Reinforcement Learning for Enhancing MLLM's Theory of Mind in Egocentric Videos
  10. Seeing but Not Thinking: Routing Distraction in Multimodal Mixture-of-Experts
  11. Test-Time Reinforcement Learning for GUI Grounding via Region Consistency
  12. ToM-Synth: Scaling Robust Theory of Mind in LLMs via 6, 912 Structured Social Units
  13. UI-Copilot: Advancing Long-Horizon GUI Automation via Tool-Integrated Policy Optimization
  14. 2.5 Years in Class: A Multimodal Textbook for Vision-Language Pretraining
  15. AskToAct: Enhancing LLMs Tool Use via Self-Correcting Clarification
  16. DB-Explore: Automated Database Exploration and Instruction Synthesis for Text-to-SQL
  17. Enhancing LLM Language Adaption through Cross-lingual In-Context Pre-training
  18. From English to Second Language Mastery: Enhancing LLMs with Cross-Lingual Continued Instruction Tuning
  19. G2LDetect: A Global-to-Local Approach for Hallucination Detection
  20. Legal Judgment Prediction based on Knowledge-enhanced Multi-Task and Multi-Label Text Classification
  21. Let LRMs Break Free from Overthinking via Self-Braking Tuning
  22. Logic: Long-form Outline Generation via Imitative and Critical Self-refinement
  23. Mind the Gap: Bridging Thought Leap for Improved Chain-of-Thought Tuning
  24. STaR-SQL: Self-Taught Reasoner for Text-to-SQL
  25. SVGenius: Benchmarking LLMs in SVG Understanding, Editing and Generation
  26. Scaling LLMs' Social Reasoning: Sprinkle Cognitive "Aha Moment" into Fundamental Long-thought Logical Capabilities
  27. Advancing Process Verification for Large Language Models via Tree-Based Preference Learning
  28. Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization
  29. Chain-of-Quizzes: Pedagogy-inspired Example Selection in In-Context-Learning
  30. De-biased Attention Supervision for Text Classification with Causality
  31. Information Re-Organization Improves Reasoning in Large Language Models
  32. Insert or Attach: Taxonomy Completion via Box Embedding
  33. Learning Global Controller in Latent Space for Parameter-Efficient Fine-Tuning
  34. Multimodal Self-Instruct: Synthetic Abstract Image and Visual Reasoning Instruction Using Language Model
  35. Progressive Tuning: Towards Generic Sentiment Abilities for Large Language Models
  36. Self-Contrast: Better Reflection Through Inconsistent Solving Perspectives
  37. TaskBench: Benchmarking Large Language Models for Task Automation
  38. TimeToM: Temporal Space is the Key to Unlocking the Door of Large Language Models' Theory-of-Mind
  39. Triad: A Framework Leveraging a Multi-Role LLM-based Agent to Solve Knowledge Base Question Answering
  40. Unleashing the Power of LLMs in Court View Generation by Stimulating Internal Knowledge and Incorporating External Knowledge