PPaperPicks

Jian Cheng

Chinese Academy of Sciences, Institute of Automation, National Laboratory of Pattern Recognition, Beijing, China

28 papers at tracked venues · 22 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. A Universal Self-Attention Enhancement for Bridging Low-bit Quantization and Vision Transformers
  2. Deep (Predictive) Discounted Counterfactual Regret Minimization
  3. FARSS: Fisher-Optimized Adaptive Low-Rank and Singular-Vector Selection for Knowledge-Preserving Fine-Tuning
  4. An Open-Ended Learning Framework for Opponent Modeling
  5. Bi-Level Knowledge Transfer for Multi-Task Multi-Agent Reinforcement Learning
  6. DartQuant: Efficient Rotational Distribution Calibration for LLM Quantization
  7. EAC-MoE: Expert-Selection Aware Compressor for Mixture-of-Experts Large Language Models
  8. Exploring Contextual Attribute Density in Referring Expression Counting
  9. Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning
  10. LoRaDA: Low-Rank Direct Attention Adaptation for Efficient LLM Fine-tuning
  11. Maximum Entropy Reinforcement Learning with Diffusion Policy
  12. Offline Opponent Modeling with Truncated Q-driven Instant Policy Refinement
  13. Q-Mamba: Towards more efficient Mamba models via post-training quantization
  14. RQT: Hierarchical Residual Quantization for Multi-Model Compression
  15. Training LLMs for Optimization Modeling via Iterative Data Synthesis and Structured Validation
  16. AID-DTI: Accelerating High-Fidelity Diffusion Tensor Imaging with Detail-Preserving Model-Based Deep Learning
  17. Dynamic Discounted Counterfactual Regret Minimization
  18. Efficient Multi-task Reinforcement Learning with Cross-Task Policy Guidance
  19. GraphLeak: Patient Record Leakage through Gradients with Knowledge Graph
  20. HGCN2SP: Hierarchical Graph Convolutional Network for Two-Stage Stochastic Programming
  21. Intrinsic Action Tendency Consistency for Cooperative Multi-Agent Reinforcement Learning
  22. Minimizing Weighted Counterfactual Regret with Optimistic Online Mirror Descent
  23. Not All Tasks Are Equally Difficult: Multi-Task Deep Reinforcement Learning with Dynamic Depth Routing
  24. Opponent Modeling with In-context Search
  25. Patch-Aware Sample Selection for Efficient Masked Image Modeling
  26. RobNODDI: Robust NODDI Parameter Estimation with Adaptive Sampling Under Continuous Representation
  27. Towards Efficient Spiking Transformer: a Token Sparsification Framework for Training and Inference Acceleration
  28. Towards Offline Opponent Modeling with In-context Learning