PPaperPicks

Qi (Cheems) Wang

Tsinghua University, Department of Automation, Beijing, China

17 papers at tracked venues · 17 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Can Prompt Difficulty be Online Predicted for Accelerating RL Finetuning of Reasoning Models?
  2. LoRA in LoRA: Towards Parameter-Efficient Architecture Expansion for Continual Visual Instruction Tuning
  3. Trustworthy Foundation Models for Web Intelligence: Causal Perspectives and Challenges
  4. Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
  5. DynaPrompt: Dynamic Test-Time Prompt Tuning
  6. Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments
  7. Gains: Fine-grained Federated Domain Adaptation in Open Set
  8. H3D-DGS: Exploring Heterogeneous 3D Motion Representation for Deformable 3D Gaussian Splatting
  9. Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
  10. RHYTHM: Reasoning with Hierarchical Temporal Tokenization for Human Mobility
  11. Robust Fast Adaptation from Adversarially Explicit Task Distribution Generation
    SIGKDD 2025 · Qi (Cheems) Wang
  12. Selective Learning for Deep Time Series Forecasting
  13. VideoRFT: Incentivizing Video Reasoning Capability in MLLMs via Reinforced Fine-Tuning
    NeurIPS 2025 · Qi (Cheems) Wang
  14. Balanced Confidence Calibration for Graph Neural Networks
  15. Doubly Mild Generalization for Offline Reinforcement Learning
  16. Offline Reinforcement Learning with OOD State Correction and OOD Action Suppression
  17. Reducing Fine-Tuning Memory Overhead by Approximate and Memory-Sharing Backpropagation