PPaperPicks

Weili Guan

32 papers at tracked venues · 32 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Amplifying Discrepancies: Exploiting Macro and Micro Inconsistencies for Image Manipulation Localization
  2. Cross-Granularity Hypergraph Retrieval-Augmented Generation for Multi-hop Question Answering
  3. HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models
  4. PersonalAlign: Hierarchical Implicit Intent Alignment for Personalized GUI Agent with Long-Term User-Centric Records
  5. Resonating with RoPE: Spectral Quantization for High-Fidelity Key Cache Compression
  6. Reusable Experiences: Latent Routing and Modular Composition in LLMs
  7. SAT: Balancing Reasoning Accuracy and Efficiency with Stepwise Adaptive Thinking
  8. StructAlign: Structured Cross-Modal Alignment for Continual Text-to-Video Retrieval
  9. Breakthrough Sensor-Limited Single View: Towards Implicit Temporal Dynamics for Time Series Domain Adaptation
  10. Content-aware Balanced Spectrum Encoding in Masked Modeling for Time Series Classification
  11. Curriculum Coarse-to-Fine Selection for High-IPC Dataset Distillation
  12. DCount: Decoupled Spatial Perception and Attribute Discrimination for Referring Expression Counting
  13. Debiased Curriculum Adaptation for Safe Transfer Learning in Chest X-Ray Classification
  14. ENCODER: Entity Mining and Modification Relation Binding for Composed Image Retrieval
  15. Embodied Crowd Counting
  16. Enhancing GUI Agent with Uncertainty-Aware Self-Trained Evaluator
  17. FALCON: Resolving Visual Redundancy and Fragmentation in High-Resolution Multimodal Large Language Models via Visual Registers
  18. HUD: Hierarchical Uncertainty-Aware Disambiguation Network for Composed Video Retrieval
  19. Handling Imbalanced Pseudolabels for Vision-Language Models with Concept Alignment and Confusion-Aware Calibrated Margin
  20. Lightweight Relational Proposal Network with Dual-Branch Distillation for Video Moment Retrieval
  21. Meta Guidance: Incorporating Inductive Biases into Deep Time Series Imputers
  22. Object-Shot Enhanced Grounding Network for Egocentric Video
  23. PTQ1.61: Push the Real Limit of Extremely Low-Bit Post-Training Quantization Methods for Large Language Models
  24. PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning
  25. Social Debiasing for Fair Multi-Modal LLMs
  26. Spatial Understanding from Videos: Structured Prompts Meet Simulation Data
  27. Towards Stable and Storage-efficient Dataset Distillation: Matching Convexified Trajectory
  28. UAV-ON: A Benchmark for Open-World Object Goal Navigation with Aerial Agents
  29. Unified Transferability Metrics for Time Series Foundation Models
  30. Boosting Transferability and Discriminability for Time Series Domain Adaptation
  31. MoME: Mixture of Multimodal Experts for Generalist Multimodal Large Language Models
  32. PROMOTE: Prior-Guided Diffusion Model with Global-Local Contrastive Learning for Exemplar-Based Image Translation