PPaperPicks

Yixin Cao

Fudan University, School of Computer Science, Shanghai, China

43 papers at tracked venues · 35 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. CriticLean: Critic-Guided Reinforcement Learning for Mathematical Formalization
  2. PRISM: Probabilistic Reward Model with Inherent Structural Modeling
  3. Rethinking the Role of Entropy in Optimizing Tool-Use Behaviors for Large Language Model Agents
  4. SCALER: Synthetic Scalable Adaptive Learning Environment for Reasoning
  5. Thinking Traps in Long Chain-of-Thought: A Measurable Study and Trap-Aware Adaptive Restart
  6. Are LLMs Rational Investors? A Study on the Financial Bias in LLMs
  7. Boosting Chart-to-Code Generation in MLLM via Dual Preference-Guided Refinement
  8. Breaking the Reasoning Barrier A Survey on LLM Complex Reasoning through the Lens of Self-Evolution
  9. Com² : A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models
  10. Disentangling Language and Culture for Evaluating Multilingual Large Language Models
  11. EvoWiki: Evaluating LLMs on Evolving Knowledge
  12. ForgerySleuth: Empowering Multimodal Large Language Models for Image Manipulation Detection
  13. Grounded-VideoLLM: Sharpening Fine-grained Temporal Grounding in Video Large Language Models
  14. Learning 3D Anisotropic Noise Distributions Improves Molecular Force Fields
  15. Long Context vs. RAG: Strategies for Processing Long Documents in LLMs
  16. Multi-Programming Language Sandbox for LLMs
  17. Precise Localization of Memories: A Fine-grained Neuron-level Knowledge Editing Technique for LLMs
  18. RM-Bench: Benchmarking Reward Models of Language Models with Subtlety and Style
  19. S3cMath: Spontaneous Step-Level Self-Correction Makes Large Language Models Better Mathematical Reasoners
  20. Simulation-Free Hierarchical Latent Policy Planning for Proactive Dialogues
  21. Towards Storage-Efficient Visual Document Retrieval: An Empirical Study on Reducing Patch-Level Embeddings
  22. XFinBench: Benchmarking LLMs in Complex Financial Problem Solving and Reasoning
  23. A + B: A General Generator-Reader Framework for Optimizing LLMs to Unleash Synergy Potential
  24. Analyzing Temporal Complex Events with Large Language Models? A Benchmark towards Temporal, Long Context Understanding
  25. Automating Dataset Updates Towards Reliable and Timely Evaluation of Large Language Models
  26. Complex Logical Query Answering by Calibrating Knowledge Graph Completion Models
  27. Finding and Editing Multi-Modal Neurons in Pre-Trained Transformers
  28. Improving Large Language Models in Event Relation Logical Prediction
  29. Intuitive or Dependent? Investigating LLMs' Behavior Style to Conflicting Prompts
  30. Knowledge Graph Completion by Intermediate Variables Regularization
  31. LLMs Assist NLP Researchers: Critique Paper (Meta-)Reviewing
  32. LLMs-as-Instructors: Learning from Errors Toward Automating Model Improvement
  33. MMLONGBENCH-DOC: Benchmarking Long-context Document Understanding with Visualizations
  34. Meaningful Learning: Enhancing Abstract Reasoning in Large Language Models via Generic Fact Guidance
  35. Navigating the Nuances: A Fine-grained Evaluation of Vision-Language Navigation
  36. Planning Like Human: A Dual-process Framework for Dialogue Planning
  37. Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 3: System Demonstrations), ACL 2024, Bangkok, Thailand, August 11-16, 2024
    ACL 2024 · Yixin Cao
  38. QRMeM: Unleash the Length Limitation through Question then Reflection Memory Mechanism
  39. Quantifying and Mitigating Unimodal Biases in Multimodal Large Language Models: A Causal Perspective
  40. Recognizing Everything from All Modalities at Once: Grounded Multimodal Universal Information Extraction
  41. SciAgent: Tool-augmented Language Models for Scientific Reasoning
  42. Towards Verifiable Generation: A Benchmark for Knowledge-aware Language Model Attribution
  43. X-Eval: Generalizable Multi-aspect Text Evaluation via Augmented Instruction Tuning with Auxiliary Evaluation Aspects