PPaperPicks

Bo An

Nanyang Technological University, Singapore

68 papers at tracked venues · 56 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AgentOCR: Reimagining Agent History via Optical Self-Compression
  2. ArchetypeTrader: Reinforcement Learning for Selecting and Refining Learnable Strategic Archetypes in Quantitative Trading
  3. Bayesian Robust Financial Trading with Adversarial Synthetic Market Data
  4. C2PO: Diagnosing and Disentangling Bias Shortcuts in LLMs
  5. FinWorld: An All-in-One Open-Source Platform for End-to-End Financial AI Research and Deployment
  6. FineFT: Efficient and Risk-Aware Ensemble Reinforcement Learning for Futures Trading
  7. GDBA Revisited: Unleashing the Power of Guided Local Search for Distributed Constraint Optimization
  8. LBM: Hierarchical Large Auto-Bidding Model via Reasoning and Acting
  9. LongSpec: Long-Context Lossless Speculative Decoding with Efficient Drafting and Verification
  10. SeDev: Structured Semantic Exploration for LLM-Driven Code Generation
  11. A Closer Look at Backdoor Attacks on CLIP
  12. A Survey on Trustworthy LLM Agents: Threats and Countermeasures
  13. AURO: Reinforcement Learning for Adaptive User Retention Optimization in Recommender Systems
  14. AgentStudio: A Toolkit for Building General Virtual Agents
  15. Cradle: Empowering Foundation Agents towards General Computer Control
  16. Deciphering the Extremes: A Novel Approach for Pathological Long-tailed Recognition in Scientific Discovery
  17. Dual-Head Knowledge Distillation: Enhancing Logits Utilization with an Auxiliary Head
  18. EconGym: A Scalable AI Testbed with Diverse Economic Tasks
  19. Efficient Last-Iterate Convergence in Solving Extensive-Form Games
  20. Empirical Study on Robustness and Resilience in Cooperative Multi-Agent Reinforcement Learning
  21. Enhancing Sub-Optimal Trajectory Stitching: Spatial Composition RvS for Offline RL
  22. Establishing Linear Surrogate Regret Bounds for Convex Smooth Losses via Convolutional Fenchel-Young Losses
  23. GAS: Generative Auto-bidding with Post-training Search
  24. Generative Auto-Bidding with Value-Guided Explorations
  25. Group-in-Group Policy Optimization for LLM Agent Training
  26. Improving Reward Models with Proximal Policy Exploration for Preference-Based Reinforcement Learning
  27. Incentivizing LLMs to Self-Verify Their Answers
  28. Influence-Based Fair Selection for Sample-Discriminative Backdoor Attack
  29. Let's Revise Step-by-Step: A Unified Local Search Framework for Code Generation with LLMs
  30. MF-LLM: Simulating Population Decision Dynamics via a Mean-Field Large Language Model Framework
  31. OPHR: Mastering Volatility Trading with Multi-Agent Deep Reinforcement Learning
  32. OpticalNet: An Optical Imaging Dataset and Benchmark Beyond the Diffraction Limit
  33. Policy Optimization under Imperfect Human Interactions with Agent-Gated Shared Autonomy
  34. Policy Regularization on Globally Accessible States in Cross-Dynamics Reinforcement Learning
  35. Q-Adapter: Customizing Pre-trained LLMs to New Preferences with Forgetting Mitigation
  36. Removing Prompt-template Bias in Reinforcement Learning from Human Feedback
  37. Representation Surgery in Model Merging with Probabilistic Modeling
  38. Towards Efficient Online Tuning of VLM Agents via Counterfactual Soft Reinforcement Learning
  39. A Multimodal Foundation Agent for Financial Trading: Tool-Augmented, Diversified, and Generalist
  40. Configurable Mirror Descent: Towards a Unification of Decision Making
  41. Consistent Hierarchical Classification with A Generalized Metric
  42. Consistent Multi-Class Classification from Multiple Unlabeled Datasets
  43. DAG-Based Column Generation for Adversarial Team Games
  44. EarnHFT: Efficient Hierarchical Reinforcement Learning for High Frequency Trading
  45. Grasper: A Generalist Pursuer for Pursuit-Evasion Problems
  46. IMM: An Imitative Reinforcement Learning Approach with Predictive Representation Learning for Automatic Market Making
  47. Improving Unsupervised Hierarchical Representation With Reinforcement Learning
  48. Latent Logic Tree Extraction for Event Sequence Explanation from LLMs
  49. MaNo: Exploiting Matrix Norm for Unsupervised Accuracy Estimation Under Distribution Shifts
  50. MacroHFT: Memory Augmented Context-aware Reinforcement Learning On High Frequency Trading
  51. Market-GAN: Adding Control to Financial Market Data Generation with Semantic Context
  52. Mitigating Underfitting in Learning to Defer with Consistent Losses
  53. On the Vulnerability of Adversarially Trained Models Against Two-faced Attacks
  54. PoRank: A Practical Framework for Learning to Rank Policies
  55. Reinforcement Learning from Diverse Human Preferences
  56. Reinforcement Learning with Maskable Stock Representation for Portfolio Management in Customizable Stock Pools
  57. Reinforcement Nash Equilibrium Solver
  58. Reinforcement Nash Equilibrium Solver
  59. Resisting Stochastic Risks in Diffusion Planners with the Trajectory Aggregation Tree
  60. S2AC: Energy-Based Reinforcement Learning with Stein Soft Actor Critic
  61. Safe and Robust Subgame Exploitation in Imperfect Information Games
  62. Self-adaptive PSRO: Towards an Automatic Population-based Game Solver
  63. Solving Homogeneous and Heterogeneous Cooperative Tasks with Greedy Sequential Execution
  64. Synapse: Trajectory-as-Exemplar Prompting with Memory for Computer Control
  65. Transition-Informed Reinforcement Learning for Large-Scale Stackelberg Mean-Field Games
  66. True Knowledge Comes from Practice: Aligning Large Language Models with Embodied Environments via Reinforcement Learning
  67. vMFER: Von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement
  68. vMFER: von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement of Actor-Critic Algorithms