PPaperPicks

Yifan Wang

52 papers at tracked venues · 35 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. BraSTORM: A Dual-Branch Self-Supervised Framework for EEG Representation Learning via Input-Level Spatio-Temporal Decomposition
    AAAI 2026 · Yifan Wang
  2. Can MLLMs Reason Beyond Language? VisReason: A Comprehensive Benchmark for Vision-Centric Reasoning
  3. Chat2Trade: Automating Financial RFQ Parsing with Fine-Tuned LLMs
  4. InterYard: Investigating E-Plants as Mediators for Attuning Human to Biorhythms in Future Cities
  5. MdaIF: Robust One-Stop Multi-Degradation-Aware Image Fusion with Language-Driven Semantics
  6. Pin City Book: A PCB-based Tangible User Interface for Location-based Puzzle Games
  7. Render-of-Thought: Rendering Textual Chain-of-Thought as Images for Visual Latent Reasoning
    ACL 2026 · Yifan Wang
  8. TAPO: Dynamic Teacher and Perturbed Answer Injection for Policy Optimization
  9. TiKMiX: Efficient Semi-Dynamic Data Mixture via Data Influence for LLM Pre-training
    ACL 2026 · Yifan Wang
  10. UnAC: Adaptive Visual Prompting with Abstraction and Stepwise Checking for Complex Multimodal Reasoning
    ACL 2026 · Yifan Wang
  11. AVF-MAE++: Scaling Affective Video Facial Masked Autoencoders via Efficient Audio-Visual Self-Supervised Learning
  12. DAAC: Discrepancy-Aware Adaptive Contrastive Learning for Medical Time series
    NeurIPS 2025 · Yifan Wang
  13. DOT: Dynamic Knob Selection and Online Sampling for Automated Database Tuning
    VLDB 2025 · Yifan Wang
  14. Discovering Influential Neuron Path in Vision Transformers
    ICLR 2025 · Yifan Wang
  15. Dissecting and Mitigating Diffusion Bias via Mechanistic Interpretability
  16. Dual Prompt Learning for Adapting Vision-Language Models to Downstream Image-Text Retrieval
    ACM MM 2025 · Yifan Wang
  17. EIC Framework for Hand Exoskeletons Based on a Multimodal Large Language Model
  18. Enhancing Large Language Model Performance with Gradient-Based Parameter Selection
  19. FTCFormer: Fuzzy Token Clustering Transformer for Image Classification
  20. Fusionsense: Bridging Common Sense, Vision, and Touch for Robust Sparse-View Reconstruction
  21. Generalization Performance of Hypergraph Neural Networks
    WWW 2025 · Yifan Wang
  22. Granular-Ball-Induced Multiple Kernel K-Means
  23. HOLA: Enhancing Audio-visual Deepfake Detection via Hierarchical Contextual Aggregations and Efficient Pre-training
  24. Improving LLM Reasoning through Interpretable Role-Playing Steering
  25. JTD-UAV: MLLM-Enhanced Joint Tracking and Description Framework for Anti-UAV Systems
    CVPR 2025 · Yifan Wang
  26. LLM-Guided Semantic Relational Reasoning for Multimodal Intent Recognition
  27. Memory or Reasoning? Explore How LLMs Compute Mixed Arithmetic Expressions
  28. MonoDGP: Monocular 3D Object Detection with Decoupled-Query and Geometry-Error Priors
  29. Motion-Agent: A Conversational Framework for Human Motion Generation with LLMs
  30. NUMINA: A Natural Understanding Benchmark for Multi-dimensional Intelligence and Numerical Reasoning Abilities
  31. OTSurv: A Novel Multiple Instance Learning Framework for Survival Prediction with Heterogeneity-Aware Optimal Transport
  32. Ouroboros: Single-Step Diffusion Models for Cycle-Consistent Forward and Inverse Rendering
  33. PhotoEcho: Facilitating Intergenerational Dialogue Through AI-Enhanced Family Photograph Narratives
  34. RitualResonate: Embodied Haptic Interaction with Chinese Chime Bells Bianzhong
  35. Themis: Toward Stable Near-Zero Queuing Delay in Congestion Control for Low-Latency Interactive Video Streaming
  36. Understanding Users' Perceptions and Expectations toward a Social Balloon Robot via an Exploratory Study
  37. Unlocking Multimodal Mathematical Reasoning via Process Reward Model
  38. A Thorough Examination of Decoding Methods in the Era of LLMs
  39. B2MAPO: A Batch-by-Batch Multi-Agent Policy Optimization to Balance Performance and Efficiency
  40. Bootstrap Deep Metric for Seed Expansion in Attributed Networks
  41. Building Robust Video-Level Deepfake Detection via Audio-Visual Local-Global Interactions
    ACM MM 2024 · Yifan Wang
  42. CDe: Focus on the Color Differences in Diabetic Foot Images
    MICCAI 2024 · Yifan Wang
  43. Deep Reinforcement Learning for Early Diagnosis of Lung Cancer
    AAAI 2024 · Yifan Wang
  44. E3V-K5: An Authentic Benchmark for Redefining Video-Based Energy Expenditure Estimation
  45. EgoPAT3Dv2: Predicting 3D Action Target from 2D Egocentric Vision for Human-Robot Interaction
  46. End-to-end Spatio-Temporal Information Aggregation For Micro-Action Detection
  47. InsCL: A Data-efficient Continual Learning Paradigm for Fine-tuning Large Language Models with Instructions
    NAACL 2024 · Yifan Wang
  48. MultiSQL: A Schema-Integrated Context-Dependent Text2SQL Dataset with Diverse SQL Operations
  49. MultiTrust: A Comprehensive Benchmark Towards Trustworthy Multimodal Large Language Models
  50. Online Rotor Fault Detection and Isolation for Vertical Takeoff and Landing Vehicles
  51. Quasi-static Path Planning for Continuum Robots By Sampling on Implicit Manifold
    ICRA 2024 · Yifan Wang
  52. Token-Level Contrastive Learning with Modality-Aware Prompting for Multimodal Intent Recognition