PPaperPicks

Ye Yuan

Beijing Institute of Technology, China

61 papers at tracked venues · 58 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. BRIEF: Bi-level Coreset Selection for Efficient Instruction Tuning in LLMs
  2. ConvD: Attention Enhanced Dynamic Convolutional Embeddings for Knowledge Graph Completion (Extended Abstract)
  3. DORA: A Dual-Objective Reinforcement Learning Framework for Effective and Efficient Multimodal Agentic Search
  4. Demystifying Uncertainty in LLMs: Active Calibration between Concepts and Human Evaluations
  5. Efficient Neural-Symbolic Data System via Multi-Agent Collaboration
    ICDE 2026 · Ye Yuan
  6. Lightweight 2-Hop Labels for Reachability Queries on Large-Scale Graphs
  7. Unstructured Data Analysis using LLMs: A Comprehensive Benchmark
  8. Aquila: A High-Concurrency System for Incremental Graph Query
  9. Backdoor Attacks on Graph Classification via Data Augmentation and Dynamic Poisoning
  10. Budgeted Strong Community Search in Heterogeneous Graphs
  11. Counting Cohesive Subgraphs with Hereditary Properties
  12. CrossEM: A Prompt Tuning Framework for Cross-Modal Entity Matching
  13. CrossETR: A Semantic-Driven Framework for Entity Matching Across Images and Graph
  14. DocDB: A Database for Unstructured Document Analysis
  15. Doctopus: A System for Budget-aware Structural Data Extraction from Unstructured Documents
  16. Doctopus: Budget-aware Structural Table Extraction from Unstructured Documents
  17. Efficient Maximum Fair Clique Search Over Large Networks
  18. Errata for "CGgraph: An Ultra-fast Graph Processing System on Modern Commodity CPU-GPU Co-processor"
  19. Fira: Can We Achieve Full-rank Training of LLMs Under Low-rank Constraint?
  20. Generalization Bounds for Kolmogorov-Arnold Networks (KANs) and Enhanced KANs with Lower Lipschitz Complexity
  21. Handling Label Noise via Instance-Level Difficulty Modeling and Dynamic Optimization
  22. Harnessing Diversity for Important Data Selection in Pretraining Large Language Models
  23. Lava: Language Driven Scalable and Versatile Traffic Video Analytics
  24. Nezha: An Efficient Distributed Graph Processing System on Heterogeneous Hardware
  25. Open3DSearch: Zero-Shot Precise Retrieval of 3D Shapes Using Text Descriptions
  26. Prompt Tuning In a Compact Attribute Space
  27. QUEST: Query Optimization in Unstructured Document Analysis
  28. QaVA: Query-Aware Video Analysis Framework Based on Data Access Pattern
  29. Towards Multi-Table Learning: A Novel Paradigm for Complementarity Quantification and Integration
  30. Truss Decomposition in Hypergraphs
  31. Two Birds with One Stone: Efficient Deep Learning over Mislabeled Data through Subset Selection
  32. VideoRFT: Incentivizing Video Reasoning Capability in MLLMs via Reinforced Fine-Tuning
  33. Across Images and Graphs for Question Answering
  34. Attributed Network Embedding in Streaming Style
  35. Authenticated Keyword Search on Large-Scale Graphs in Hybrid-Storage Blockchains
  36. Authenticated Subgraph Matching in Hybrid-Storage Blockchains
  37. AutoGraph: Enabling Visual Context via Graph Alignment in Open Domain Multi-Modal Dialogue Generation
  38. CGgraph: An Ultra-fast Graph Processing System on Modern Commodity CPU-GPU Co-processor
  39. Cooperative Global Path Planning for Multiple Platforms
  40. Cross Online Ride-Sharing for Multiple-Platform Cooperations in Spatial Crowdsourcing
  41. Efficient Partial Order Based Transaction Processing for Permissioned Blockchains
  42. EquiPocket: an E(3)-Equivariant Geometric Graph Neural Network for Ligand Binding Site Prediction
  43. FDNet: Feature Decoupling Framework for Trajectory Prediction
  44. Feed: Towards Personalization-Effective Federated Learning
  45. GShop: Towards Flexible Pricing for Graph Statistics
  46. IDE: A System for Iterative Mislabel Detection
  47. ITPNet: Towards Instantaneous Trajectory Prediction for Autonomous Driving
  48. Importance-aware Shared Parameter Subspace Learning for Domain Incremental Learning
  49. Keypoint-based Progressive Chain-of-Thought Distillation for LLMs
  50. LaKD: Length-agnostic Knowledge Distillation for Trajectory Prediction with Any Length Observations
  51. Label Constrained Reachability Queries on Time Dependent Graphs
  52. LakeBench: A Benchmark for Discovering Joinable and Unionable Tables in Data Lakes
  53. LakeCompass: An End-to-End System for Table Maintenance, Search and Analysis in Data Lakes
  54. MisDetect: Iterative Mislabel Detection using Early Loss
  55. Mitigating Data Scarcity in Supervised Machine Learning Through Reinforcement Learning Guided Data Generation
  56. Multivariate Time Series Cleaning under Speed Constraints
  57. On the Road to Portability: Compressing End-to-End Motion Planner for Autonomous Driving
  58. Privacy-Enhanced Database Synthesis for Benchmark Publishing
  59. RL-ISLAP: A Reinforcement Learning Framework for Industrial-Scale Linear Assignment Problems at Alipay
  60. Separation Is for Better Reunion: Data Lake Storage at Huawei
  61. nsDB: Architecting the Next Generation Database by Integrating Neural and Symbolic Systems (Vision)
    VLDB 2024 · Ye Yuan