PPaperPicks

Liang Wang

Chinese Academy of Sciences, Institute of Automation, Center for Research on Intelligent Perception and Computing, Beijing, China

61 papers at tracked venues · 48 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. EC-RAG: Towards Efficient Edge-Cloud Retrieval-Augmented Generation Systems
    ICDE 2026 · Liang Wang
  2. From Completion to Editing: Unlocking Context-Aware Code Infilling via Search-and-Replace Instruction Tuning
  3. Gait Transformer: End-to-End Transformer Backbone for Gait Recognition
  4. Scaling Law for Multimodal Large Language Model Supervised Fine-Tuning
  5. What Should I Cite? A RAG Benchmark for Academic Citation Prediction
  6. AeroDuo: Aerial Duo for UAV-based Vision and Language Navigation
  7. Attention-guided Self-reflection for Zero-shot Hallucination Detection in Large Language Models
  8. AuroRA: Breaking Low-Rank Bottleneck of LoRA with Nonlinear Mapping
  9. BridgeVLA: Input-Output Alignment for Efficient 3D Manipulation Learning with Vision-Language Models
  10. Bridging Gait Recognition and Large Language Models Sequence Modeling
  11. DAA: Amplifying Unknown Discrepancy for Test-Time Discovery
  12. DAGPrompT: Pushing the Limits of Graph Prompting with a Distribution-aware Graph Prompt Tuning Approach
  13. Debiasing Multimodal Large Language Models via Penalization of Language Priors
  14. Divide-Then-Align: Honest Alignment based on the Knowledge Boundary of RAG
  15. EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow
  16. Frequency-Domain Multi-modal Fusion for Language-Guided Medical Image Segmentation
  17. GOOD: Training-Free Guided Diffusion Sampling for Out-of-Distribution Detection
  18. GenPilot: A Multi-Agent System for Test-Time Prompt Optimization in Image Generation
  19. Integrating Protein Dynamics into Structure-Based Drug Design via Full-Atom Stochastic Flows
  20. KELE: Residual Knowledge Erasure for Enhanced Multi-hop Reasoning in Knowledge Editing
  21. Learning Fine-Grained Alignment for Aerial Vision-Dialog Navigation
  22. Learning against Non-credible Second-Price Auctions
  23. MM-RLHF: The Next Step Forward in Multimodal LLM Alignment
  24. MME-RealWorld: Could Your Multimodal LLM Challenge High-Resolution Real-World Scenarios that are Difficult for Humans?
  25. MME-VideoOCR: Evaluating OCR-Based Capabilities of Multimodal LLMs in Video Scenarios
  26. MolSpectra: Pre-training 3D Molecular Representation with Multi-modal Energy Spectra
  27. OS Agents: A Survey on MLLM-based Agents for Computer, Phone and Browser Use
  28. Personalized Text Generation with Contrastive Activation Steering
  29. Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning
  30. QBasicVSR: Temporal Awareness Adaptation Quantization for Video Super-Resolution
  31. REACT: Representation Extraction And Controllable Tuning to Overcome Overfitting in LLM Knowledge Editing
  32. Reinforcing Spatial Reasoning in Vision-Language Models with Interwoven Thinking and Visual Drawing
  33. SHARP: Steering Hallucination in LVLMs via Representation Engineering
  34. SINCon: Mitigate LLM-Generated Malicious Message Injection Attack for Rumor Detection
  35. SPENet: Self-guided Prototype Enhancement Network for Few-Shot Medical Image Segmentation
  36. VicKAM: Visual Conceptual Knowledge Guided Action Map for Weakly Supervised Group Activity Recognition
  37. An Efficient Local Search Algorithm for Large GD Advertising Inventory Allocation with Multilinear Constraints
  38. AnchorGT: Efficient and Flexible Attention Architecture for Scalable Graph Transformers
  39. Antigen-Specific Antibody Design via Direct Energy-based Preference Optimization
  40. Attribute-Guided Pedestrian Retrieval: Bridging Person Re-ID with Internal Attribute Variability
  41. Beyond Efficiency: Molecular Data Pruning for Enhanced Generalization
  42. CAMLO: Cross-Attentive Multi-View Network for Long-Term Origin-Destination Flow Prediction
    SDM 2024 · Liang Wang
  43. DIVE: Subgraph Disagreement for Graph Out-of-Distribution Generalization
  44. DecompOpt: Controllable and Decomposed Diffusion Models for Structure-based Molecular Optimization
  45. EX-FEVER: A Dataset for Multi-hop Explainable Fact Verification
  46. Everyday Object Meets Vision-and-Language Navigation Agent via Backdoor
  47. Evolving to the Future: Unseen Event Adaptive Fake News Detection on Social Media
  48. Free Lunch for Gait Recognition: A Novel Relation Descriptor
  49. Investigating Compositional Challenges in Vision-Language Models for Visual Grounding
  50. Laner-GNN: Adapting to Long-Tail Degree Distribution with Latent Neighborhood Restorers
  51. Logical Closed Loop: Uncovering Object Hallucinations in Large Vision-Language Models
  52. Modality-Balanced Learning for Multimedia Recommendation
  53. Percentile Risk-Constrained Budget Pacing for Guaranteed Display Advertising in Online Optimization
  54. PromptIQA: Boosting the Performance and Generalization for No-Reference Image Quality Assessment via Prompts
  55. Reprogramming Pretrained Target-Specific Diffusion Models for Dual-Target Drug Design
  56. Rethinking Graph Masked Autoencoders through Alignment and Uniformity
    AAAI 2024 · Liang Wang
  57. Semantic Evolvement Enhanced Graph Autoencoder for Rumor Detection
  58. Stabilizing Policy Gradients for Stochastic Differential Equations via Consistency with Perturbation Process
  59. Stealthy Attack on Large Language Model based Recommendation
  60. Text-Guided Molecule Generation with Diffusion Language Model
  61. VLKEB: A Large Vision-Language Model Knowledge Editing Benchmark