PPaperPicks

Xuming Hu

Hong Kong University of Science and Technology Guangzhou (HKUST-GZ), Guangzhou, China

73 papers at tracked venues · 56 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Are We Using the Right Benchmark: An Evaluation Framework for Visual Token Compression Methods
  2. CSSG: A Continuous Spatio-temporal Graph Learning Framework with Scalable Spatial Granularity
  3. Compliance-to-Code: Enhancing Financial Compliance Checking via Code Generation
  4. Deconstructing Pre-training: Knowledge Attribution Analysis in MoE and Dense Models
  5. DualScope: Capturing Critical Spatial and Temporal Cues for Distracted Driving Activity Recognition
  6. ErrorRadar: Benchmarking Complex Mathematical Reasoning of Multimodal Large Language Models Via Error Detection
  7. Optimal Expert-Attention Allocation in Mixture-of-Experts: A Scalable Law for Dynamic Model Design
  8. Position: Multimodal Large Language Models Can Significantly Advance Scientific Reasoning
  9. Sculpting the Vector Space: Towards Efficient Multi-Vector Visual Document Retrieval via Prune-then-Merge Framework
  10. Sharp Eyes and Memory for VideoLLMs: Information-Aware Visual Token Pruning for Efficient and Reliable VideoLLM Reasoning
  11. StreamMeCo: Long-Term Agent Memory Compression for Efficient Streaming Video Understanding
  12. Thinking Economically: A Hierarchical Framework for Adaptive-Complexity Reasoning in LLMs
  13. Vision-Language Introspection: Mitigating Overconfident Hallucinations in MLLMs via Interpretable Bi-Causal Steering
  14. A Survey of Mathematical Reasoning in the Era of Multimodal Large Language Model: Benchmark, Method & Challenges
  15. A Survey on Proactive Defense Strategies Against Misinformation in Large Language Models
  16. Benchmarking Multi-modal Semantic Segmentation under Sensor Failures: Missing and Noisy Modality Robustness
  17. Can LLM Watermarks Robustly Prevent Unauthorized Knowledge Distillation?
  18. Can Watermarked LLMs be Identified by Users via Crafted Prompts?
  19. Capturing Nuanced Preferences: Preference-Aligned Distillation for Small Language Models
  20. ChunkKV: Semantic-Preserving KV Cache Compression for Efficient Long-Context LLM Inference
  21. Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning
  22. Dataset Distillation with Neural Characteristic Function: A Minmax Perspective
  23. DeKeyNLU: Enhancing Natural Language to SQL Generation through Task Decomposition and Keyword Extraction
  24. Decoding Knowledge Attribution in Mixture-of-Experts: A Framework of Basic-Refinement Collaboration and Efficiency Analysis
  25. DiscoverGPT: Multi-task Fine-tuning Large Language Model for Related Table Discovery
    NAACL 2025 · Xuming Hu
  26. Do BERT-Like Bidirectional Models Still Perform Better on Text Classification in the Era of LLMs?
  27. Don't Just Chase "Highlighted Tokens" in MLLMs: Revisiting Visual Holistic Context Retention
  28. Dynamic Expert Specialization: Towards Catastrophic Forgetting-Free Multi-Domain MoE Adaptation
  29. EssayJudge: A Multi-Granular Benchmark for Assessing Automated Essay Scoring Capabilities of Multimodal Large Language Models
  30. Exploring Response Uncertainty in MLLMs: An Empirical Evaluation under Misleading Scenarios
  31. From Guesswork to Guarantee: Towards Faithful Multimedia Web Forecasting with TimeSieve
  32. Gnothi Seauton: Empowering Faithful Self-Interpretability in Black-Box Transformers
  33. HyperG: Hypergraph-Enhanced LLMs for Structured Knowledge
  34. ICT: Image-Object Cross-Level Trusted Intervention for Mitigating Object Hallucination in Large Vision-Language Models
  35. Internal Chain-of-Thought: Empirical Evidence for Layer-wise Subtask Scheduling in LLMs
  36. LLM Agents for Education: Advances and Applications
  37. LazyMAR: Accelerating Masked Autoregressive Models Via Feature Caching
  38. LoTA-QAF: Lossless Ternary Adaptation for Quantization-Aware Fine-Tuning
  39. Look Twice Before You Answer: Memory-Space Visual Retracing for Hallucination Mitigation in Multimodal Large Language Models
  40. MMUnlearner: Reformulating Multimodal Machine Unlearning in the Era of Multimodal Large Language Models
  41. MathAgent: Leveraging a Mixture-of-Math-Agent Framework for Real-World Multimodal Mathematical Error Detection
  42. Mitigating Modality Prior-Induced Hallucinations in Multimodal Large Language Models via Deciphering Attention Causality
  43. OmniSAM: Omnidirectional Segment Anything Model for UDA in Panoramic Semantic Segmentation
  44. OneForecast: A Universal Framework for Global and Regional Weather Forecasting
  45. PhysicsArena: The First Multimodal Physics Reasoning Benchmark Exploring Variable, Process, and Solution Dimensions
  46. Pierce the Mists, Greet the Sky: Decipher Knowledge Overshadowing via Knowledge Circuit Analysis
  47. PolyJoin: Semantic Multi-key Joinable Table Search in Data Lakes
    NAACL 2025 · Xuming Hu
  48. RTV-Bench: Benchmarking MLLM Continuous Perception, Understanding and Reasoning through Real-Time Video
  49. RealRAG: Retrieval-augmented Realistic Image Generation via Self-reflective Contrastive Learning
  50. Reducing Unimodal Bias in Multi-Modal Semantic Segmentation With Multi-Scale Functional Entropy Regularization
  51. Reefknot: A Comprehensive Benchmark for Relation Hallucination Evaluation, Analysis and Mitigation in Multimodal Large Language Models
  52. Rethinking the Roles of Large Language Models in Chinese Grammatical Error Correction
  53. SafeEraser: Enhancing Safety in Multimodal Large Language Models through Multimodal Machine Unlearning
  54. StructFact: Reasoning Factual Knowledge from Structured Data with Large Language Models
  55. UAlign: Leveraging Uncertainty Estimations for Factuality Alignment on Large Language Models
  56. UltraWiki: Ultra-Fine-Grained Entity Set Expansion with Negative Seed Entities
  57. Unlocking Speech Instruction Data Potential with Query Rewriting
  58. VLA-Mark: A cross modal watermark for large vision-language alignment models
  59. A Semantic Invariant Robust Watermark for Large Language Models
  60. An Unforgeable Publicly Verifiable Watermark for Large Language Models
  61. Evaluating Robustness of Generative Search Engine on Adversarial Factoid Questions
    ACL 2024 · Xuming Hu
  62. LLMArena: Assessing Capabilities of Large Language Models in Dynamic Multi-Agent Environments
  63. LongGenBench: Long-context Generation Benchmark
  64. MMNeuron: Discovering Neuron-Level Domain-Specific Interpretation in Multimodal Large Language Model
  65. MarkLLM: An Open-Source Toolkit for LLM Watermarking
  66. Mind's Mirror: Distilling Self-Evaluation Capability and Comprehensive Thinking from Large Language Models
  67. On the Robustness of Document-Level Relation Extraction Models to Entity Name Variations
  68. Preventing and Detecting Misinformation Generated by Large Language Models
  69. Refiner: Restructure Retrieved Content Efficiently to Advance Question-Answering Capabilities
  70. Three Heads Are Better than One: Improving Cross-Domain NER with Progressive Decomposed Network
    AAAI 2024 · Xuming Hu
  71. Towards Understanding Factual Knowledge of Large Language Models
    ICLR 2024 · Xuming Hu
  72. Unraveling Babel: Exploring Multilingual Activation Patterns of LLMs and Their Applications
  73. When LLMs Meet Cunning Texts: A Fallacy Understanding Benchmark for Large Language Models