PPaperPicks

Jenq-Neng Hwang

University of Washington, Seattle, USA

31 papers at tracked venues · 20 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. 3DSceneEditor: Controllable 3D Scene Editing with Gaussian Splatting
  2. BCL: Bayesian In-Context Learning Framework for Information Extraction
  3. Multiple Human Motion Understanding
  4. milliMamba: Specular-Aware Human Pose Estimation via Dual mmWave Radar with Multi-Frame Mamba Fusion
  5. Attention Consistency for LLMs Explanation
  6. AuroraCap: Efficient, Performant Video Detailed Captioning and a New Benchmark
  7. Automatic Fish Age Prediction Using Deep Machine Learning: Combining Otolith Image, FT-NIR Spectra and Metadata Features
  8. Bayesian Optimization for Controlled Image Editing via LLMs
  9. CityGen: Infinite and Controllable City Layout Generation
  10. Exploring Probabilistic Modeling Beyond Domain Generalization for Semantic Segmentation
  11. Graph Canvas for Controllable 3D Scene Generation
  12. Human Motion Instruction Tuning
  13. Is Meta-Learning Out? Rethinking Unsupervised Few-Shot Classification with Limited Entropy
  14. Learning an Efficient Optimizer via Hybrid-Policy Sub-Trajectory Balance
  15. Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression
  16. MoCount: Motion-Based Repetitive Action Counting
  17. MonoTAKD: Teaching Assistant Knowledge Distillation for Monocular 3D Object Detection
  18. PAMN: Multi-phase Correlation Modeling for Contrast-Enhanced 3D Medical Image Retrieval
  19. The Role of Deductive and Inductive Reasoning in Large Language Models
  20. ToSA: Token Merging with Spatial Awareness
  21. Warehouse Spatial Question Answering with LLM Agent 1st Place Solution of the 9th AI City Challenge Track 3
  22. Zero-shot 3D Question Answering via Voxel-based Dynamic Token Compression
  23. APTPose: Anatomy-aware Pre-Training for 3D Human Pose Estimation
  24. An Online Approach and Evaluation Method for Tracking People Across Cameras in Extremely Long Video Sequence
  25. Contrastive Pre-Training with Multi-View Fusion for No-Reference Point Cloud Quality Assessment
  26. MovieChat: From Dense Token to Sparse Memory for Long Video Understanding
  27. NTIRE 2024 Challenge on HR Depth from Images of Specular and Transparent Surfaces
  28. RT-Pose: A 4D Radar Tensor-Based 3D Human Pose Estimation and Localization Benchmark
  29. ToddlerAct: A Toddler Action Recognition Dataset for Gross Motor Development Assessment
  30. TransHuPR: Cross-View Fusion Transformer for Human Pose Estimation Using mmWave Radar
  31. UniAP: Towards Universal Animal Perception in Vision via Few-Shot Learning