PPaperPicks

Ning Yu

Netflix Eyeline Studios

22 papers at tracked venues · 15 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Beyond the Safety Tax: Mitigating Unsafe Text-to-Image Generation via External Safety Rectification
  2. MAViS: A Multi-Agent Framework for Long-Sequence Video Storytelling
  3. VChain: Chain-of-Visual-Thought for Reasoning in Video Generation
  4. BLIP-3: A Family of Open Large Multimodal Models
  5. Detecting Adversarial Data Using Perturbation Forgery
  6. FlashDepth: Real-Time Streaming Video Depth Estimation at 2K Resolution
  7. Go-with-the-Flow: Motion-Controllable Video Diffusion Models Using Real-Time Warped Noise
  8. Infinite-Resolution Integral Noise Warping for Diffusion Models
  9. Lux Post Facto: Learning Portrait Performance Relighting with Conditional Video Diffusion and a Hybrid Dataset
  10. Reference-Based 3D-Aware Image Editing with Triplanes
  11. Text2Data: Low-Resource Data Generation with Textual Control
  12. C-RAG: Certified Generation Risks for Retrieval-Augmented Language Models
  13. FASTTRACK: Reliable Fact Tracing via Clustering and LLM-Powered Evidence Validation
  14. HIVE: Harnessing Human Feedback for Instructional Visual Editing
  15. Hierarchical Point Attention for Indoor 3D Object Detection
  16. Inside the Black Box: Detecting Data Leakage in Pre-Trained Language Encoders
  17. LayoutDETR: Detection Transformer Is a Good Multimodal Layout Designer
    ECCV 2024 · Ning Yu
  18. RigorLLM: Resilient Guardrails for Large Language Models against Undesired Content
  19. Shadowcast: Stealthy Data Poisoning Attacks Against Vision-Language Models
  20. SimSCOOD: Systematic Analysis of Out-of-Distribution Generalization in Fine-tuned Source Code Models
  21. ULIP-2: Towards Scalable Multimodal Pre-Training for 3D Understanding
  22. X-InstructBLIP: A Framework for Aligning Image, 3D, Audio, Video to LLMs and its Emergent Cross-Modal Reasoning