PPaperPicks

Kaiqi Huang

23 papers at tracked venues · 17 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. CausalStep: A Benchmark for Explicit Stepwise Causal Reasoning in Videos
  2. ImagerySearch: Adaptive Test-Time Search for Video Generation Beyond Semantic Dependency Constraints
  3. No-Regret Strategy Solving in Imperfect-Information Games via Pre-Trained Embedding
  4. RefRea: Reference-Guided Reasoning with Meta-Cognition for Accurate Language Model Agents
  5. SAMem: State-Aware Memory as a Fine-Grained Memory for LLM Agents in Decision-Making
  6. ATCTrack: Aligning Target-Context Cues with Dynamic Target States for Robust Vision-Language Tracking
  7. CSTrack: Enhancing RGB-X Tracking via Compact Spatiotemporal Features
  8. Constructive Conflict-Driven Multi-Agent Reinforcement Learning for Strategic Diversity
  9. LLM Data Selection and Utilization via Dynamic Bi-level Optimization
  10. Sequential Preference Optimization: Multi-Dimensional Preference Alignment with Implicit Reward Modeling
  11. Uncertainty-Aware Opponent Modeling for Deep Reinforcement Learning
  12. Unveiling Chain of Step Reasoning for Vision-Language Models with Fine-grained Rewards
  13. ADMN: Agent-Driven Modular Network for Dynamic Parameter Sharing in Cooperative Multi-Agent Reinforcement Learning
  14. Beyond Accuracy: Tracking more like Human via Visual Search
  15. DDAE: Towards Deep Dynamic Vision BERT Pretraining
  16. DTLLM-VLT: Diverse Text Generation for Visual Language Tracking Based on LLM
  17. Information Bottleneck Based Data Correction in Continual Learning
  18. MemVLT: Vision-Language Tracking with Adaptive Memory-based Prompts
  19. PeLK: Parameter-Efficient Large Kernel ConvNets with Peripheral Convolution
  20. Population-Based Diverse Exploration for Sparse-Reward Multi-Agent Tasks
  21. Revealing the Dark Secrets of Extremely Large Kernel ConvNets on Robustness
  22. Safe Reinforcement Learning with Free-form Natural Language Constraints and Pre-Trained Language Models
  23. TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient