PPaperPicks

Dongmei Zhang

Microsoft Research Asia, Beijing, China

76 papers at tracked venues · 49 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. CAST: Achieving Stable LLM-based Text Analysis for Data Analytics
  2. CI-Work: Benchmarking Contextual Integrity in Enterprise LLM Agents
  3. DUET: Joint Exploration of User-Item Profiles in Recommendation System
  4. EgoMemory: Memory-Augmented Personalized Retrieval for Long-Context Egocentric Video
  5. Gradient-Guided Multi-Judge Prompt Optimization
  6. Jupiter: Enhancing LLM Data Analysis Capabilities via Notebook and Inference-Time Value-Guided Search
  7. LLM Reasoning as Trajectories: Step-Specific Representation Geometry and Correctness Signals
  8. Learning to Refine: Self-Refinement of Parallel Reasoning in LLMs
  9. Not All Tokens Matter: Towards Efficient LLM Reasoning via Token Significance in Reinforcement Learning
  10. Quantifying and Improving the Robustness of Retrieval-Augmented Language Models Against Spurious Features in Grounding Data
  11. RepoGenesis: Benchmarking End-to-End Microservice Generation from Readme to Repository
  12. SheetBrain: A Neuro-Symbolic Agent for Accurate Reasoning over Complex and Large Spreadsheets
  13. Zipage: Maintain High Request Concurrency for LLM Reasoning through Compressed PagedAttention
  14. AXIS: Efficient Human-Agent-Computer Interaction with API-First LLM-Based Agents
  15. AdaptFlow: Adaptive Workflow Optimization via Meta-Learning
  16. AllHands :Ask Me Anything on Large-scale Verbatim Feedback via Large Language Models
  17. Auto-Test: Learning Semantic-Domain Constraints for Unsupervised Error Detection in Tables
  18. Consensus-Robust Transfer Attacks via Parameter and Representation Perturbations
  19. DI-BENCH: Benchmarking Large Language Models on Dependency Inference with Testable Repositories at Scale
  20. ESF: Efficient Sensitive Fingerprinting for Black-Box Tamper Detection of Large Language Models
  21. Enhancing Adversarial Transferability with Checkpoints of a Single Model's Training
  22. ExeCoder: Empowering Large Language Models with Executability Representation for Code Translation
  23. From Reasoning to Answer: Empirical, Attention-Based and Mechanistic Insights into Distilled DeepSeek R1 Models
  24. GUI-Actor: Coordinate-Free Visual Grounding for GUI Agents
  25. ICL-Bandit: Relevance Labeling in Advertisement Recommendation Systems via LLM
  26. Illustration Layout Generation for Slide Enhancement with Pixel-based Diffusion Model
  27. Large Language Models can Deliver Accurate and Interpretable Time Series Anomaly Detection
  28. Learning Identifiable Structures Helps Avoid Bias in DNN-based Supervised Causal Learning
  29. LettinGo: Explore User Profile Generation for Recommendation System
  30. MMTU: A Massive Multi-Task Table Understanding and Reasoning Benchmark
  31. Navigating the Unknown: A Chat-Based Collaborative Interface for Personalized Exploratory Tasks
  32. OpenRCA: Can Large Language Models Locate the Root Cause of Software Failures?
  33. Ploutos: Towards Explainable Stock Movement Prediction with Financial Large Language Model
  34. Privacy in Action: Towards Realistic Privacy Mitigation and Evaluation for LLM-Powered Agents
  35. ProtoRAIL: A Risk-cognizant Imitation Agent for Adaptive vCPU Oversubscription In the Cloud
  36. RESF: Regularized-Entropy-Sensitive Fingerprinting for Black-Box Tamper Detection of Large Language Models
  37. Reason-before-Retrieve: One-Stage Reflective Chain-of-Thoughts for Training-Free Zero-Shot Composed Image Retrieval
  38. RuAG: Learned-rule-augmented Generation for Large Language Models
  39. SDBF: Steep-Decision-Boundary Fingerprinting for Hard-Label Tampering Detection of DNN Models
  40. SWE-bench Goes Live!
  41. Self-Evolved Reward Learning for LLMS
  42. SheetDesigner: MLLM-Powered Spreadsheet Layout Generation with Rule-Based and Vision-Based Reflection
  43. Skeleton-Guided-Translation: A Benchmarking Framework for Code Repository Translation with Fine-Grained Quality Evaluation
  44. Table-LLM-Specialist: Language Model Specialists for Tables using Iterative Fine-tuning
  45. TableLoRA: Low-rank Adaptation on Table Structure Understanding for Large Language Models
  46. TablePilot: Recommending Human-Preferred Tabular Data Analysis with Large Language Models
  47. Thread: A Logic-Based Data Organization Paradigm for How-To Question Answering with Retrieval Augmented Generation
  48. Token-level Proximal Policy Optimization for Query Generation
  49. TwT: Thinking without Tokens by Habitual Reasoning Distillation with Multi-Teachers' Guidance
  50. UFO: A UI-Focused Agent for Windows OS Interaction
  51. WarriorCoder: Learning from Expert Battles to Augment Code Large Language Models
  52. WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct
  53. Auto-Formula: Recommend Formulas in Spreadsheets using Contrastive Learning for Table Representations
  54. AutoRAG-HP: Automatic Online Hyper-Parameter Tuning for Retrieval-Augmented Generation
  55. Breaking Language Barriers in Multilingual Mathematical Reasoning: Insights and Observations
  56. COIN: Chance-Constrained Imitation Learning for Safe and Adaptive Resource Oversubscription under Uncertainty
  57. Call Me When Necessary: LLMs can Efficiently and Faithfully Reason over Structured Environments
  58. CoCoST: Automatic Complex Code Generation with Online Searching and Correctness Testing
  59. EfficientRAG: Efficient Retriever for Multi-Hop Question Answering
  60. Encoding Spreadsheets for Large Language Models
  61. Everything of Thoughts: Defying the Law of Penrose Triangle for Thought Generation
  62. IconDM: Text-Guided Icon Set Expansion Using Diffusion Models
  63. LLMLingua-2: Data Distillation for Efficient and Faithful Task-Agnostic Prompt Compression
  64. Nissist: An Incident Mitigation Copilot based on Troubleshooting Guides
  65. Pre-trained KPI Anomaly Detection Model Through Disentangled Transformer
  66. PromptIntern: Saving Inference Costs by Internalizing Recurrent Prompt during Large Language Model Fine-tuning
  67. Revisiting VAE for Unsupervised Time Series Anomaly Detection: A Frequency Perspective
  68. SOIL: Score Conditioned Diffusion Model for Imbalanced Cloud Failure Prediction
  69. Scalable Differentiable Causal Discovery in the Presence of Latent Confounders with Skeleton Posterior
  70. Source Free Graph Unsupervised Domain Adaptation
  71. TAP4LLM: Table Provider on Sampling, Augmenting, and Packing Semi-structured Data for Large Language Model Reasoning
  72. Table Meets LLM: Can Large Language Models Understand Structured Table Data? A Benchmark and Empirical Study
  73. Table-GPT: Table Fine-tuned GPT for Diverse Table Tasks
  74. Text-to-Image Generation for Abstract Concepts
  75. Text2Analysis: A Benchmark of Table Question Answering with Advanced Data Analysis and Unclear Queries
  76. Towards Stricter Black-box Integrity Verification of Deep Neural Network Models