PPaperPicks

Yujiu Yang

Tsinghua University, Shenzhen International Graduate School, China

72 papers at tracked venues · 50 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. A.S.E: A Repository-Level Benchmark for Evaluating Security in AI-Generated Code
  2. CreativeBench: Benchmarking and Enhancing Machine Creativity via Self-Evolving Challenges
  3. Distributional Clarity: The Hidden Driver of RL-Friendliness in Large Language Models
  4. O-DisCo-Edit: Object Distortion Control for Unified Realistic Video Editing
  5. ProFit: Leveraging High-Value Signals in SFT via Probability-Guided Token Selection
  6. Probing the Safety Robustness of LLMs in Latent Space
  7. SCAN: Structured Capability Assessment and Navigation for LLMs
  8. Towards Token-Level Text Anomaly Detection
  9. Advancing Visual Large Language Model for Multi-Granular Versatile Perception
  10. Chain-of-Reasoning: Towards Unified Mathematical Reasoning in Large Language Models via a Multi-Paradigm Perspective
  11. ChartMimic: Evaluating LMM's Cross-Modal Reasoning Capability via Chart-to-Code Generation
  12. CoHD: A Counting-Aware Hierarchical Decoding Framework for Generalized Referring Expression Segmentation
  13. Critical Tokens Matter: Token-Level Contrastive Estimation Enhances LLM's Reasoning Capability
  14. DnLUT: Ultra-Efficient Color Image Denoising via Channel-Aware Lookup Tables
  15. EpiCoder: Encompassing Diversity and Complexity in Code Generation
  16. Fair Text-Attributed Graph Representation Learning
  17. From Evasion to Concealment: Stealthy Knowledge Unlearning for LLMs
  18. HyperSeg: Hybrid Segmentation Assistant with Fine-grained Visual Perceiver
  19. IDA-VLM: Towards Movie Understanding via ID-Aware Large Vision-Language Model
  20. IDOL: Instant Photorealistic 3D Human Creation from a Single Image
  21. Improving CTR Prediction with Graph-Enhanced Interest Networks for Sparse Behavior Sequences
  22. Improving Video Generation with Human Feedback
  23. Instructseg: Unifying Instructed Visual Segmentation with Multi-Modal Large Language Models
  24. Invisible Entropy: Towards Safe and Efficient Low-Entropy LLM Watermarking
  25. IterComp: Iterative Composition-Aware Feedback Learning from Model Gallery for Text-to-Image Generation
  26. LLM2: Let Large Language Models Harness System 2 Reasoning
  27. MaskCD: Mitigating LVLM Hallucinations by Image Head Masked Contrastive Decoding
  28. MorphMark: Flexible Adaptive Watermarking for Large Language Models
  29. PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning
  30. PocketSR: The Super-Resolution Expert in Your Pocket Mobiles
  31. ProReflow: Progressive Reflow with Decomposed Velocity
  32. Robust and Minimally Invasive Watermarking for EaaS
  33. Scalable Image Tokenization with Index Backpropagation Quantization
  34. ShifCon: Enhancing Non-Dominant Language Capabilities with a Shift-based Multilingual Contrastive Framework
  35. Teaching Your Models to Understand Code via Focal Preference Alignment
  36. Text Anomaly Detection with Simplified Isolation Kernel
  37. ToM: Leveraging Tree-oriented MapReduce for Long-Context Reasoning in Large Language Models
  38. Unlocking Multimodal Mathematical Reasoning via Process Reward Model
  39. Wan-Move: Motion-controllable Video Generation via Latent Trajectory Guidance
  40. A Comprehensive Study of Multimodal Large Language Models for Image Quality Assessment
  41. A Thorough Examination of Decoding Methods in the Era of LLMs
  42. Accelerating Diffusion Models for Inverse Problems through Shortcut Sampling
  43. Addressing Entity Translation Problem via Translation Difficulty and Context Diversity
  44. AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents
  45. Bridging the Gap: A Unified Video Comprehension Framework for Moment Retrieval and Highlight Detection
  46. CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
  47. CoSeR: Bridging Image and Language for Cognitive Super-Resolution
  48. Connecting Large Language Models with Evolutionary Algorithms Yields Powerful Prompt Optimizers
  49. Continuous Invariance Learning
  50. CriticBench: Benchmarking LLMs for Critique-Correct Reasoning
  51. Deep Evolutional Instant Interest Network for CTR Prediction in Trigger-Induced Recommendation
  52. Encouraging Divergent Thinking in Large Language Models through Multi-Agent Debate
  53. HoLLMwood: Unleashing the Creativity of Large Language Models in Screenwriting via Role Playing
  54. Incremental Residual Concept Bottleneck Models
  55. InsCL: A Data-efficient Continual Learning Paradigm for Fine-tuning Large Language Models with Instructions
  56. LoCa: Logit Calibration for Knowledge Distillation
  57. MLLMGuard: A Multi-dimensional Safety Evaluation Suite for Multimodal Large Language Models
  58. Mitigating Reversal Curse in Large Language Models via Semantic-aware Permutation Training
  59. Not All Tokens Are What You Need for Pretraining
  60. PTD-SQL: Partitioning and Targeted Drilling with LLMs in Text-to-SQL
  61. Prior Bilinear-Based Models for Knowledge Graph Completion
  62. RealCompo: Balancing Realism and Compositionality Improves Text-to-Image Diffusion Models
  63. Rolling Shutter Correction with Intermediate Distortion Flow Estimation
  64. SciAgent: Tool-augmented Language Models for Scientific Reasoning
  65. Spurious Feature Diversification Improves Out-of-distribution Generalization
  66. Taming Lookup Tables for Efficient Image Retouching
  67. TextBind: Multi-turn Interleaved Multimodal Instruction-following in the Wild
  68. ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving
  69. ToolBeHonest: A Multi-level Hallucination Diagnostic Benchmark for Tool-Augmented Large Language Models
  70. Unchosen Experts Can Contribute Too: Unleashing MoE Models' Power by Self-Contrast
  71. Universal Segmentation at Arbitrary Granularity with Language Instruction
  72. Weight-Inherited Distillation for Task-Agnostic BERT Compression