PPaperPicks

Tong Wu

56 papers at tracked venues · 45 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. ClayMind: Materializing the Ineffable through AI-Guided Tangible Art for Mental Wellness
  2. DySy-Det: A Synergistic Framework with Dynamic Reconstruction-Path Consistency for AI-Generated Image Detection
  3. Eguard: Defending LLM Embeddings Against Inversion Attacks via Text Mutual Information Optimization
  4. Targeting the Needle, Ignoring the Haystack: Anchoring Crucial Cues for Evolving Scam Call Detection via an LLM-Assisted Classifier
    ACL 2026 · Tong Wu
  5. 3DTopia-XL: Scaling High-quality 3D Asset Generation via Primitive Diffusion
  6. Absolute Zero: Reinforced Self-play Reasoning with Zero Data
  7. An Efficient Hybrid Vision Transformer for Tinyml Applications
  8. Bootstrap3D: Improving Multi-View Diffusion Model with Synthetic Data
  9. ByTheWay: Boost Your Text-to-Video Generation Model to Higher Quality in a Training-free Way
  10. Chemistry3D: Robotic Interaction Toolkit for Chemistry Experiments
  11. DepthSSC: Monocular 3D Semantic Scene Completion via Depth-Spatial Alignment and Voxel Adaptation
  12. EventPillars: Pillar-based Efficient Representations for Event Data
  13. FSFM: A Generalizable Face Security Foundation Model via Self-Supervised Facial Representation Learning
  14. Fast Non-convex Matrix Sensing with Optimal Sample Complexity
  15. GenDoP: Auto-regressive Camera Trajectory Generation as a Director of Photography
  16. Generative Dreams: Rethinking GenAI Design Through a Community-based Approach with Recently Incarcerated, Gang Affiliated, and At-risk Young Adults at a Trauma Informed Arts Center
  17. HAC-LOCO: Learning Hierarchical Active Compliance Control for Quadruped Locomotion under Continuous External Disturbances
  18. Hi3DEval: Advancing 3D Generation Evaluation with Hierarchical Validity
  19. HiFlow: Training-free High-Resolution Image Generation with Flow-Aligned Guidance
  20. IDArb: Intrinsic Decomposition for Arbitrary Number of Input Views and Illuminations
  21. Imagine360: Immersive 360 Video Generation from Perspective Anchor
  22. Instructional Segment Embedding: Improving LLM Safety with Instruction Hierarchy
    ICLR 2025 · Tong Wu
  23. LOKI: A Comprehensive Synthetic Data Detection Benchmark using Large Multimodal Models
  24. Label Distribution Propagation-based Label Completion for Crowdsourcing
    ICML 2025 · Tong Wu
  25. Light-a-Video: Training-Free Video Relighting via Progressive Light Fusion
  26. MotionClone: Training-Free Motion Cloning for Controllable Video Generation
  27. OmniMMI: A Comprehensive Multi-modal Interaction Benchmark in Streaming Video Contexts
  28. ReliabilityRAG: Effective and Provably Robust Defense for RAG-based Web-Search
  29. RemapVR: An Immersive Authoring Tool for Rapid Prototyping of Remapped Interaction in VR
  30. Sensing Surface Patches in Volume Rendering for Inferring Signed Distance Functions
  31. The Task Shield: Enforcing Task Alignment to Defend Against Indirect Prompt Injection in LLM Agents
  32. TokenSwift: Lossless Acceleration of Ultra Long Sequence Generation
    ICML 2025 · Tong Wu
  33. Towards a Golden Classifier-Free Guidance Path via Foresight Fixed Point Iterations
  34. Video World Models with Long-term Spatial Memory
    NeurIPS 2025 · Tong Wu
  35. VideoAVE: A Multi-Attribute Video-to-Text Attribute Value Extraction Dataset and Benchmark Models
  36. X-Prompt: Generalizable Auto-Regressive Visual Learning with In-Context Prompting
  37. Alpha-CLIP: A CLIP Model Focusing on Wherever you Want
  38. An Efficient Recipe for Long Context Extension via Middle-Focused Positional Encoding
    NeurIPS 2024 · Tong Wu
  39. ArkVale: Efficient Generative LLM Inference with Recallable Key-Value Eviction
  40. Class-Aware Sample Weight Learning for Cross-Modal Unsupervised Domain Adaptation in Cross-User Wearable Human Activity Recognition
    ECAI 2024 · Tong Wu
  41. ComboVerse: Compositional 3D Assets Creation Using Spatially-Aware Diffusion Guidance
  42. DeformNet: Latent Space Modeling and Dynamics Prediction for Deformable Object Manipulation
  43. FiVA: Fine-grained Visual Attribute Dataset for Text-to-Image Diffusion Models
    NeurIPS 2024 · Tong Wu
  44. GPT-4V(ision) is a Human-Aligned Evaluator for Text-to-3D Generation
    CVPR 2024 · Tong Wu
  45. GPT4Point: A Unified Framework for Point-Language Understanding and Generation
  46. GREATS: Online Selection of High-Quality Data for LLM Training in Every Iteration
  47. HarmonicNeRF: Geometry-Informed Synthetic View Augmentation for 3D Scene Reconstruction in Driving Scenarios
  48. Improving Depth Gradient Continuity in Transformers: A Comparative Study on Monocular Depth Estimation with CNN
  49. Large-Vocabulary 3D Diffusion Model with Transformer
  50. Make-it-Real: Unleashing Large Multimodal Model for Painting 3D Objects with Realistic Materials
  51. Omni6D: Large-Vocabulary 3D Object Dataset for Category-Level 6D Object Pose Estimation
  52. PediatricsGPT: Large Language Models as Chinese Medical Assistants for Pediatric Applications
  53. Privacy-Preserving In-Context Learning for Large Language Models
    ICLR 2024 · Tong Wu
  54. QE-BEV: Query Evolution for Bird's Eye View Object Detection in Varied Contexts
  55. Robust Data Clustering with Outliers via Transformed Tensor Low-Rank Representation
    AISTATS 2024 · Tong Wu
  56. SoftCLIP: Softer Cross-Modal Alignment Makes CLIP Stronger