PPaperPicks

Jian Wang

Snap Inc., Venice, CA, USA

27 papers at tracked venues · 22 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. 3DAlign-DAER: Dynamic Attention Policy and Efficient Retrieval Strategy for Fine-grained 3D-Text Alignment at Scale
  2. Cost-Effective Communication: An Auction-based Method for Language Agent Interaction
  3. LLM-CAS: Dynamic Neuron Perturbation for Real-Time Hallucination Correction
  4. Nash-Pruned CredMAS: Dynamic Panel Pruning for VLM-MAS using Nash-based Selection and Doubly-Robust Credits
  5. Reinforcement Learning for Diffusion LLMs via Energy-Based Gibbs Alignment
  6. Snapmoji: Instant Generation of Animatable Dual-Stylized Avatars
  7. Top-Down Semantic Refinement for Image Captioning
  8. 3D-Agent: A Tri-Modal Multi-Agent Responsive Framework for Comprehensive 3D Object Annotation
  9. 4KAgent: Agentic Any Image to 4K Super-Resolution
  10. CF-VLM: CounterFactual Vision-Language Fine-tuning
  11. DrDiff: Dynamic Routing Diffusion with Hierarchical Attention for Breaking the Efficiency-Quality Trade-off
  12. Ego4o: Egocentric Human Motion Capture and Understanding from Multi-Modal Input
    CVPR 2025 · Jian Wang
  13. FRAME: Floor-aligned Representation for Avatar Motion from Egocentric Video
    CVPR 2025 ·
    Andrea Boscolo Camiletto
  14. GAM-Agent: Game-Theoretic and Uncertainty-Aware Collaboration for Complex Visual Reasoning
  15. GuideSR: Rethinking Guidance for One-Step High-Fidelity Diffusion-Based Super-Resolution
  16. KABB: Knowledge-Aware Bayesian Bandits for Dynamic Expert Coordination in Multi-Agent Systems
  17. Ponimator: Unfolding Interactive Pose for Versatile Human-Human Interaction Animation
  18. Scenemi: Motion In-Betweening for Modeling Human-Scene Interactions
  19. SnapMoGen: Human Motion Generation from Expressive Texts
  20. T2Bs: Text-to-Character Blendshapes via Video Generation
  21. VQualA 2025 Challenge on Engagement Prediction for Short Videos: Methods and Results
  22. VQualA 2025 Challenge on Face Image Quality Assessment: Methods and Results
  23. Clearer Frames, Anytime: Resolving Velocity Ambiguity in Video Frame Interpolation
  24. DSL-FIQA: Assessing Facial Image Quality via Dual-Set Degradation Learning and Landmark-Guided Transformer
  25. Delving Deep into Engagement Prediction of Short Videos
  26. Holodepth: Programmable Depth-Varying Projection via Computer-Generated Holography
  27. RobustSAM: Segment Anything Robustly on Degraded Images