PPaperPicks

Bo Zheng

Alibaba Group, Beijing, China

110 papers at tracked venues · 86 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. All Languages Matter: Understanding and Mitigating Language Bias in Multilingual RAG
  2. CE-RM: A Pointwise Generative Reward Model Optimized via Two-Stage Rollout and Unified Criteria
  3. CoMeT: Collaborative Memory Transformer for Efficient Long Context Modeling
  4. Contribution-aware Token Compression for Efficient Video Understanding via Reinforcement Learning
  5. DeepPhy: Benchmarking Agentic VLMs on Physical Reasoning
  6. Equip Pre-ranking with Target Attention by Residual Quantization
  7. From Pseudo-Balancing to True Specialization: Memory-Aware Routing for Mixture-of-Experts
  8. GFlowGR: Fine-tuning Generative Recommendation Frameworks with Generative Flow Networks
  9. Geoparsing: Diagram Parsing for Plane and Solid Geometry with a Unified Formal Language
  10. IMPACTNet: Unifying Auto-bidding in End-to-End Merged Auctions
  11. Learning from the Irrecoverable: Error-Localized Policy Optimization for Tool-Integrated LLM Reasoning
  12. Learning to Trust: Dynamic Utilization of Retrieval-Augmented Generation for E-commerce Search Relevance
  13. LoFT-LLM: Low-Frequency Time-series Forecasting with Large Language Models
  14. LoRE: Enhancing Search Relevance with Progressive Chain-of-Thought and Preference Alignment
  15. MIRAGE: Towards AI-Generated Image Detection in the Wild
  16. MOON: Generative MLLM-based Multimodal Representation Learning for E-commerce Product Understanding
  17. MVGPT: Generative Materialized View Forecasting
  18. MaskTab: Scalable Masked Tabular Pretraining with Scaling Laws and Distillation for Industrial Classification
    ACL 2026 · Bo Zheng
  19. Mobile-R1: Towards Interactive Capability for VLM-Based Mobile Agent via Systematic Training
  20. Modeling Cascaded Delay Feedback for Online Net Conversion Rate Prediction: Benchmark, Insights and Solutions
  21. Multi-Behavior Sequential Modeling with Transition-Aware Graph Attention Network for E-Commerce Recommendation
  22. Multi-Branch Cooperation Networks for Enhanced Click-Through Rate Prediction in Large-Scale E-Commerce Search
  23. Navigating the Infinite Dynamic Web Space: Effective In-Context Exploration via Cognitive Multi-Agent Collaboration
  24. NebulaSQL: A Large-scale Feature Computation System for Online Recommendation
  25. PolicySim: An LLM-Based Agent Social Simulation Sandbox for Proactive Policy Optimization
  26. PretrainRL: Alleviating Factuality Hallucination of Large Language Models at the Beginning
  27. RAVR: Reference-Answer-guided Variational Reasoning for Large Language Models
  28. REVISION:Reflective Intent Mining and Online Reasoning Auxiliary for E-Commerce Visual Search System Optimization
  29. SELECting over Tokens: Curating Pre-training Data at Scale via Token Classification
  30. ThinkRec: Thinking-based recommendation via LLM
  31. Trimming the Fat: Redundancy-Aware Acceleration Framework for DGNNs
  32. USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models
  33. Uniboost: Global Coordination with Value Alignment for Fair and Efficient Traffic Allocation
  34. Unified Thinker: A General Reasoning Core for Image Generation
  35. Unlocking Scaling Law in Industrial Recommendation Systems with a Three-step Paradigm based Large User Model
  36. VALUE: Value-Aware Large Language Model for Query Rewriting via Weighted Trie in Sponsored Search
  37. 2D-DPO: Scaling Direct Preference Optimization with 2-Dimensional Supervision
  38. A Generative Re-ranking Model for List-level Multi-objective Optimization at Taobao
  39. AIGuard: A Benchmark and Lightweight Detection for E-commerce AIGC Risks
  40. AIR: Complex Instruction Generation via Automatic Iterative Refinement
  41. An Adaptable Budget Planner for Enhancing Budget-Constrained Auto-Bidding in Online Advertising
  42. Beyond Advertising: Mechanism Design for Platform-Wide Marketing Service "QuanZhanTui"
  43. Bid2X: Revealing Dynamics of Bidding Environment in Online Advertising from A Foundation Model Lens
  44. Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?
  45. Chinese SafetyQA: A Safety Short-form Factuality Benchmark for Large Language Models
  46. Chinese SimpleQA: A Chinese Factuality Evaluation for Large Language Models
  47. ChineseEcomQA: A Scalable E-commerce Concept Evaluation Benchmark for Large Language Models
  48. Computational Advertising: Recent Advances
  49. Contextual Generative Auction with Permutation-level Externalities for Online Advertising
  50. DAGPrompT: Pushing the Limits of Graph Prompting with a Distribution-aware Graph Prompt Tuning Approach
  51. DEPO: Enhancing E-commerce Image Background Generation with Short Trajectory Direct Expected Preference Optimization
  52. DMLoRA: Dynamic Multi-Subspace Low-Rank Adaptation
  53. Demons in the Detail: On Implementing Load Balancing Loss for Training Specialized Mixture-of-Expert Models
  54. Differentiable Solver Search for Fast Diffusion Sampling
  55. Do not Abstain! Identify and Solve the Uncertainty
  56. ECKGBench: Benchmarking Large Language Models in E-commerce Leveraging Knowledge Graph
  57. Enhancing Document Understanding with Group Position Embedding: A Novel Approach to Incorporate Layout Information
  58. Explainable LLM-driven Multi-dimensional Distillation for E-Commerce Relevance Learning
  59. GSID: Generative Semantic Indexing for E-Commerce Product Understanding
  60. Gated Attention for Large Language Models: Non-linearity, Sparsity, and Attention-Sink-Free
  61. Gradient Deconfliction via Orthogonal Projections onto Subspaces For Multi-task Learning
  62. HiddenDetect: Detecting Jailbreak Attacks against Multimodal Large Language Models via Monitoring Hidden States
  63. How to inject knowledge efficiently? Knowledge Infusion Scaling Law for Pre-training Large Language Models
  64. Inter: Mitigating Hallucination in Large Vision-Language Models by Interaction Guidance Sampling
  65. Learning against Non-credible Second-Price Auctions
  66. LongDocURL: a Comprehensive Multimodal Long Document Benchmark Integrating Understanding, Reasoning, and Locating
  67. M2RC-EVAL: Massively Multilingual Repository-level Code Completion Evaluation
  68. MTU-Bench: A Multi-granularity Tool-Use Benchmark for Large Language Models
  69. Minimal Impact ControlNet: Advancing Multi-ControlNet Integration
  70. Multi-task Offline Reinforcement Learning for Online Advertising in Recommender Systems
  71. OmniKV: Dynamic Context Selection for Efficient Long-Context LLMs
  72. PosterMaker: Towards High-Quality Product Poster Generation with Accurate Text Rendering
  73. ProgCo: Program Helps Self-Correction of Large Language Models
  74. RHanDS: Refining Malformed Hands for Generated Images with Decoupled Structure and Style Guidance
  75. RLAIF-V: Open-Source AI Feedback Leads to Super GPT-4V Trustworthiness
  76. Robust Data-Driven Auction Design
  77. See Beyond a Single View: Multi-Attribution Learning Leads to Better Conversion Rate Prediction
  78. See the World, Discover Knowledge: A Chinese Factuality Evaluation for Large Vision Language Models
  79. T-Stars-Poster: A Framework for Product-Centric Advertising Image Design
  80. TBGRecall: A Generative Retrieval Model for E-commerce Recommendation Scenarios
  81. Think before Recommendation: Autonomous Reasoning-enhanced Recommender
  82. Token Preference Optimization with Self-Calibrated Visual-Anchored Rewards for Hallucination Mitigation
  83. Towards Visualization-of-Thought Jailbreak Attack against Large Visual Language Models
  84. TranSUN: A Preemptive Paradigm to Eradicate Retransformation Bias Intrinsically from Regression Models in Recommender Systems
  85. UQABench: Evaluating User Embedding for Prompting LLMs in Personalized Question Answering
  86. USD: A User-Intent-Driven Sampling and Dual-Debiasing Framework for Large-Scale Homepage Recommendations
  87. User Long-Term Multi-Interest Retrieval Model for Recommendation
  88. VC4VG: Optimizing Video Captions for Text-to-Video Generation
  89. Accelerating Image Generation with Sub-path Linear Approximation Model
  90. Ad vs Organic: Revisiting Incentive Compatible Mechanism Design in E-commerce Platforms
  91. AuctionNet: A Novel Benchmark for Decision-Making in Large-Scale Games
  92. Calibration-compatible Listwise Distillation of Privileged Features for CTR Prediction
  93. ConceptMath: A Bilingual Concept-wise Benchmark for Measuring Mathematical Reasoning of Large Language Models
  94. D-CPT Law: Domain-specific Continual Pre-Training Scaling Law for Large Language Models
  95. DDK: Distilling Domain Knowledge for Efficient Large Language Models
  96. Deep Bag-of-Words Model: An Efficient and Interpretable Relevance Architecture for Chinese E-Commerce
  97. Demystify Mamba in Vision: A Linear Attention Perspective
  98. E2-LLM: Efficient and Extreme Length Extension of Large Language Models
  99. Enhancing Taobao Display Advertising with Multimodal Representations: Challenges, Approaches and Insights
  100. Exploring DCN-like architecture for fast image generation with arbitrary resolution
  101. Generative Auto-bidding via Conditional Diffusion Modeling
  102. GeoGPT4V: Towards Geometric Multi-modal Large Language Models with Geometric Image Generation
  103. GraphReader: Building Graph-based Agent to Enhance Long-Context Abilities of Large Language Models
  104. Laner-GNN: Adapting to Long-Tail Degree Distribution with Latent Neighborhood Restorers
  105. MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
  106. MetaSplit: Meta-Split Network for Limited-Stock Product Recommendation
  107. Percentile Risk-Constrained Budget Pacing for Guaranteed Display Advertising in Online Optimization
  108. Synchronized Video Storytelling: Generating Video Narrations with Structured Storyline
  109. Turbo: Informativity-Driven Acceleration Plug-In for Vision-Language Large Models
  110. Unified Visual Preference Learning for User Intent Understanding