PPaperPicks

Dongzhan Zhou

22 papers at tracked venues · 18 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Deep Research Arena: The First Exam of LLMs' Research Abilities via Seminar-Grounded Tasks
  2. Mitigating Low-Quality Reasoning in MLLMs: Self-Driven Refined Multimodal CoT with Selective Thinking and Step-wise Visual Enhancement
  3. ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition
  4. A CLIP-Powered Framework for Robust and Generalizable Data Selection
  5. Accelerating 3D Molecule Generative Models with Trajectory Diagnosis
  6. Biology-Instructions: A Dataset and Benchmark for Multi-Omics Sequence Understanding Capability of Large Language Models
  7. CFSSeg: Closed-Form Solution for Class-Incremental Semantic Segmentation of 2D Images and 3D Point Clouds
  8. CMT: A Cascade MAR with Topology Predictor for Multimodal Conditional CAD Generation
  9. Can Knowledge-Graph-based Retrieval Augmented Generation Really Retrieve What You Need?
  10. ChemVLM: Exploring the Power of Multimodal Large Language Models in Chemistry Area
  11. Critic-V: VLM Critics Help Catch VLM Errors in Multimodal Reasoning
  12. LLaMA-Berry: Pairwise Optimization for Olympiad-level Mathematical Reasoning via O1-like Monte Carlo Tree Search
  13. LabUtopia: High-Fidelity Simulation and Hierarchical Benchmark for Scientific Embodied Agents
  14. MOOSE-Chem2: Exploring LLM Limits in Fine-Grained Scientific Hypothesis Discovery via Hierarchical Search
  15. MOOSE-Chem: Large Language Models for Rediscovering Unseen Chemistry Scientific Hypotheses
  16. MokA: Multimodal Low-Rank Adaptation for MLLMs
  17. Scaling Physical Reasoning with the PHYSICS Dataset
  18. Scientists' First Exam: Probing Cognitive Abilities of MLLM via Perception, Understanding, and Reasoning
  19. SynBrain: Enhancing Visual-to-fMRI Synthesis via Probabilistic Representation Learning
  20. When Dynamic Data Selection Meets Data Augmentation: Achieving Enhanced Training Acceleration
  21. LOCR: Location-Guided Transformer for Optical Character Recognition
  22. Ref-AVS: Refer and Segment Objects in Audio-Visual Scenes