P
PaperPicks
Conferences
Xinya Du
17 papers at tracked venues · 10 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
EMNLP
×6
ACL
×5
NeurIPS
×2
AAAI
×1
ICLR
×1
ICML
×1
IROS
×1
Frequent coauthors
Liqiang Jing
DBLP profile ↗
ORCID search ↗
×3
Ruosen Li
DBLP profile ↗
ORCID search ↗
×3
Kaiyu He
DBLP profile ↗
ORCID search ↗
×1
Zhenwen Liang
DBLP profile ↗
ORCID search ↗
×1
Bowen Yan
DBLP profile ↗
ORCID search ↗
×1
Shuo Yan
DBLP profile ↗
ORCID search ↗
×1
Bofu Dong
DBLP profile ↗
ORCID search ↗
×1
Peilin Wu
DBLP profile ↗
ORCID search ↗
×1
Haojian Huang
DBLP profile ↗
ORCID search ↗
×1
Zimu Wang
DBLP profile ↗
ORCID search ↗
×1
Zonglin Yang
DBLP profile ↗
ORCID search ↗
×1
Jishnu Jaykumar P
DBLP profile ↗
ORCID search ↗
×1
Papers
FIFA: Unified Faithfulness Evaluation Framework for Text-to-Video and Video-to-Text Generation
ACL 2026
·
Liqiang Jing
DBLP profile ↗
ORCID search ↗
Is Grokking Worthwhile? Functional Analysis and Transferability of Generalization Circuits in Transformers
ACL 2026
·
Kaiyu He
DBLP profile ↗
ORCID search ↗
Your Reasoning Model is Secretly a Reward Model - Optimization-Free Verification from Experience
ACL 2026
·
Zhenwen Liang
DBLP profile ↗
ORCID search ↗
DSBench: How Far Are Data Science Agents from Becoming Data Science Experts?
ICLR 2025
·
Liqiang Jing
DBLP profile ↗
ORCID search ↗
FG-PRM: Fine-grained Hallucination Detection and Mitigation in Language Model Mathematical Reasoning
EMNLP 2025
·
Ruosen Li
DBLP profile ↗
ORCID search ↗
FIHA: Automated Fine-grained Hallucinations Evaluations in Large Vision Language Models with Davidson Scene Graphs
ACL 2025
·
Bowen Yan
DBLP profile ↗
ORCID search ↗
LMR-BENCH: Evaluating LLM Agent's Ability on Reproducing Language Modeling Research
EMNLP 2025
·
Shuo Yan
DBLP profile ↗
ORCID search ↗
SciEvent: Benchmarking Multi-domain Scientific Event Extraction
EMNLP 2025
·
Bofu Dong
DBLP profile ↗
ORCID search ↗
Search Wisely: Mitigating Sub-optimal Agentic Searches By Reducing Uncertainty
EMNLP 2025
·
Peilin Wu
DBLP profile ↗
ORCID search ↗
VistaDPO: Video Hierarchical Spatial-Temporal Direct Preference Optimization for Large Video Models
ICML 2025
·
Haojian Huang
DBLP profile ↗
ORCID search ↗
Document-level Causal Relation Extraction with Knowledge-guided Binary Question Answering
EMNLP 2024
·
Zimu Wang
DBLP profile ↗
ORCID search ↗
FaithScore: Fine-grained Evaluations of Hallucinations in Large Vision-Language Models
EMNLP 2024
·
Liqiang Jing
DBLP profile ↗
ORCID search ↗
IQA-EVAL: Automatic Evaluation of Human-Model Interactive Question Answering
NeurIPS 2024
·
Ruosen Li
DBLP profile ↗
ORCID search ↗
Large Language Models for Automated Open-domain Scientific Hypotheses Discovery
ACL 2024
·
Zonglin Yang
DBLP profile ↗
ORCID search ↗
MEQA: A Benchmark for Multi-hop Event-centric Question Answering with Explanations
NeurIPS 2024
·
Ruosen Li
DBLP profile ↗
ORCID search ↗
Making Natural Language Reasoning Explainable and Faithful
AAAI 2024
·
Xinya Du
Proto-CLIP: Vision-Language Prototypical Network for Few-Shot Learning
IROS 2024
·
Jishnu Jaykumar P
DBLP profile ↗
ORCID search ↗