PPaperPicks

Jian Yang

Nankai University, Department of Computer Science, China

114 papers at tracked venues · 93 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Beyond Static Rules: Automated Discovery of Latent Vulnerabilities in Text-to-SQL
  2. Context as a Tool: Context Management for Long-Horizon SWE-Agents
  3. Diffusion-Based Contextual Reconstruction for Point Cloud Segmentation with Limited Annotations
  4. FinSafetyBench: Evaluating LLM Safety in Real-World Financial Scenarios
  5. HumanLLM: Benchmarking and Improving LLM Anthropomorphism via Human Cognitive Patterns
  6. Modeling LLM Unlearning as an Asymmetric Two-Task Learning Problem
  7. RMLer: Synthesizing Novel Objects Across Diverse Categories via Reinforcement Mixing Learning
  8. SM3Det: A Unified Model for Multi-Modal Remote Sensing Object Detection
  9. Shaping Without Tearing: Controllable Diffeomorphic Deformations for Topology-Preserving 3D Point Cloud Augmentation
  10. Small but Mighty: Dynamic Wavelet Expert-Guided Fine-Tuning of Large-Scale Models for Optical Remote Sensing Object Segmentation
  11. SpatioTemporal Difference Network for Video Depth Super-Resolution
  12. Table-R1: Region-based Reinforcement Learning for Table Understanding
  13. Uncovering Strategic Egoism Behaviors in Large Language Models
  14. AD-GS: Object-Aware B-Spline Gaussian Splatting for Self-Supervised Autonomous Driving
  15. Advancing Textual Prompt Learning with Anchored Attributes
  16. Anchor Token Matching: Implicit Structure Locking for Training-Free AR Image Editing
  17. Beyond Flat Text: Dual Self-Inherited Guidance for Visual Text Generation
  18. Category-Aware 3D Object Composition with Disentangled Texture and Shape Multi-view Diffusion
  19. CodeArena: Evaluating and Aligning CodeLLMs on Human Preference
    EMNLP 2025 · Jian Yang
  20. Completion as Enhancement: A Degradation-Aware Selective Image Guided Network for Depth Completion
  21. Cross-View Geometric Collaboration for Generalizable Sparse View Neural Surface Reconstruction
  22. DCNOT: Diffusion-Cascaded Neural Optimal Transport for Scalable Multi-Domain Image-to-Image Translation
  23. DISTA-Net: Dynamic Closely-Spaced Infrared Small Target Unmixing
  24. DORNet: A Degradation Oriented and Regularized Network for Blind Depth Super-Resolution
  25. Deep Height Decoupling for Precise Vision-Based 3D Occupancy Prediction
  26. Depth-Centric Dehazing and Depth-Estimation from Real-World Hazy Driving Video
  27. Describe, Don't Dictate: Semantic Image Editing with Natural Language Intent
  28. Diff-Refiner: Enhancing Multi-Agent Trajectory Prediction with a Plug-and-Play Diffusion Refiner
  29. DiffPCI: Large Motion Point Cloud Frame Interpolation with Diffusion Model
  30. DuCos: Duality Constrained Depth Super-Resolution via Foundation Model
  31. Dual Manifold Regularization Steered Robust Representation Learning for Point Cloud Analysis
  32. Dual-Perspective United Transformer for Object Segmentation in Optical Remote Sensing Images
  33. Enhancing Contrastive Learning with Variable Similarity
  34. Enhancing Pseudo-Boxes via Data-Level LiDAR-Camera Fusion for Unsupervised 3D Object Detection
  35. Exploiting Multimodal Spatial-temporal Patterns for Video Object Tracking
  36. From Words to Worth: Newborn Article Impact Prediction with LLM
  37. GSRecon: Efficient Generalizable Gaussian Splatting for Surface Reconstruction from Sparse Views
  38. Generative Point Cloud Registration
  39. HORP: Human-Object Relation Priors Guided HOI Detection
  40. Harmonious Music-driven Group Choreography with Trajectory-Controllable Diffusion
  41. Hierarchical Spatio-Temporal Segmentation Network for Ejection Fraction Estimation in Echocardiography Videos
  42. IW-Bench: Evaluating Large Multimodal Models for Converting Image-to-Web
  43. InstanceCap: Improving Text-to-Video Generation via Instance-aware Structured Caption
  44. InterLCM: Low-Quality Images as Intermediate States of Latent Consistency Models for Effective Blind Face Restoration
  45. KGN-Pro: Keypoint-Based Grasp Prediction through Probabilistic 2D-3D Correspondence Learning
  46. LaTexBlend: Scaling Multi-concept Customized Generation with Latent Textual Blending
  47. Learning Cascade Ranking as One Network
  48. Learning Class Prototypes for Unified Sparse-Supervised 3D Object Detection
  49. MMAR: Towards Lossless Multi-Modal Auto-Regressive Probabilistic Modeling
    CVPR 2025 · Jian Yang
  50. MindAligner: Explicit Brain Functional Alignment for Cross-Subject Visual Decoding from Limited fMRI Data
  51. Not All Parameters Matter: Masking Diffusion Models for Enhancing Generation Ability
  52. OcRFDet: Object-Centric Radiance Fields for Multi-View 3D Object Detection in Autonomous Driving
  53. OmniBench: Towards The Future of Universal Omni-Language Models
  54. One-Prompt-One-Story: Free-Lunch Consistent Text-to-Image Generation Using a Single Prompt
  55. One-Way Ticket: Time-Independent Unified Encoder for Distilling Text-to-Image Diffusion Models
  56. OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation
  57. Pi-SQL: Enhancing Text-to-SQL with Fine-Grained Guidance from Pivot Programming Languages
  58. Pre-training a Density-Aware Pose Transformer for Robust LiDAR-based 3D Human Pose Estimation
  59. Qwen2.5-xCoder: Multi-Agent Collaboration for Multilingual Code Instruction Tuning
    ACL 2025 · Jian Yang
  60. RNG: Relightable Neural Gaussians
  61. RSAR: Restricted State Angle Resolver and Rotated SAR Benchmark
  62. RePoseD: Efficient Relative Pose Estimation With Known Depth Information
  63. Remote Photoplethysmography in Real-World and Extreme Lighting Scenarios
  64. Representation Entanglement for Generation: Training Diffusion Transformers Is Much Easier Than You Think
  65. Rethinking Point Cloud Data Augmentation: Topologically Consistent Deformation
  66. SSAIM: Not All Self-Attentions Contain Effective Spatial Structure in Diffusion Models for Text-to-Image Editing
  67. SVG-IR: Spatially-Varying Gaussian Splatting for Inverse Rendering
  68. See through the Dark: Learning Illumination-affined Representations for Nighttime Occupancy Prediction
  69. Self-Supervised Vision Graph Neural Networks Based on Contrastive Learning
  70. Self-calibration Enhanced Whole Slide Pathology Image Analysis
  71. Sketchy Bounding-box Supervision for 3D Instance Segmentation
  72. Star: Spatial-Temporal Augmentation with Text-to-Video Models for Real-World Video Super-Resolution
  73. Straighten Viscous Rectified Flow via Noise Optimization
  74. StrandHead: Text to Hair-Disentangled 3D Head Avatars Using Human-Centric Priors
  75. Synthesizing Software Engineering Data in a Test-Driven Manner
  76. Three-view Focal Length Recovery From Homographies
  77. Towards Better Spherical Sliced-Wasserstein Distance Learning with Data-Adaptive Discriminative Projection Direction
  78. UltraHR-100K: Enhancing UHR Image Synthesis with A Large-Scale High-Quality Dataset
  79. Volume-Aware Distance for Robust Similarity Learning
  80. VoxelSplat: Dynamic Gaussian Splatting as an Effective Loss for Occupancy and Flow Prediction
  81. WeatherGen: A Unified Diverse Weather Generator for LiDAR Point Clouds via Spider Mamba Diffusion
  82. Zero-shot RGB-D Point Cloud Registration with Pre-trained Large Vision Model
  83. AltNeRF: Learning Robust Neural Radiance Field via Alternating Depth-Pose Optimization
  84. Can Large Language Models Always Solve Easy Problems if They Can Solve Harder Ones?
  85. Cascade Prompt Learning for Vision-Language Model Adaptation
  86. ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance
  87. Customized Generation Reimagined: Fidelity and Editability Harmonized
  88. DCDepth: Progressive Monocular Depth Estimation in Discrete Cosine Domain
  89. Diff-Reg: Diffusion Model in Doubly Stochastic Matrix Space for Registration Problem
  90. Distilling Knowledge from Large-Scale Image Models for Object Detection
  91. Divide and Conquer: Hybrid Pre-training for Person Search
  92. Driving-Video Dehazing with Non-Aligned Regularization for Safety Assistance
  93. Efficiency Calibration of Implicit Regularization in Deep Networks via Self-paced Curriculum-Driven Singular Value Selection
  94. FastPCI: Motion-Structure Guided Fast Point Cloud Frame Interpolation
  95. Faster Diffusion: Rethinking the Role of the Encoder for Diffusion Model Inference
  96. Frequency-Spatial Entanglement Learning for Camouflaged Object Detection
  97. Fundamental Matrix Estimation Using Relative Depths
  98. Get What You Want, Not What You Don't: Image Content Suppression for Text-to-Image Diffusion Models
  99. Grid4D: 4D Decomposed Hash Encoding for High-Fidelity Dynamic Gaussian Splatting
  100. HybridBooth: Hybrid Prompt Inversion for Efficient Subject-Driven Generation
  101. MambaLLIE: Implicit Retinex-Aware Low Light Enhancement with Global-then-Local State Space
  102. Multi-Attribute Interactions Matter for 3D Visual Grounding
  103. Novel Object Synthesis via Adaptive Text-Image Harmony
  104. PromptKD: Unsupervised Prompt Distillation for Vision-Language Models
  105. Robust Similarity Learning with Difference Alignment Regularization
  106. SARDet-100K: Towards Open-Source Benchmark and ToolKit for Large-Scale SAR Object Detection
  107. SGNet: Salient Geometric Network for Point Cloud Registration
  108. SGNet: Structure Guided Network via Gradient-Frequency Awareness for Depth Map Super-resolution
  109. SHaRPose: Sparse High-Resolution Representation for Human Pose Estimation
  110. Synthesizing Text-to-SQL Data from Weak and Strong LLMs
  111. TP2O: Creative Text Pair-to-Object Generation Using Balance Swap-Sampling
  112. Text2LiDAR: Text-Guided LiDAR Point Cloud Generation via Equirectangular Transformer
  113. Token Merging for Training-Free Semantic Binding in Text-to-Image Synthesis
  114. Tri-Perspective view Decomposition for Geometry-Aware Depth Completion