PPaperPicks

Yukang Chen

21 papers at tracked venues · 21 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. TraveLLaMA: A Multimodal Travel Assistant with Large-Scale Dataset and Structured Reasoning
  2. LYRA: An Efficient and Speech-Centric Framework for Omni-Cognition
  3. LongVILA: Scaling Long-Context Visual Language Models for Long Videos
    ICLR 2025 · Yukang Chen
  4. MindOmni: Unleashing Reasoning Generation in Vision Language Models with RGPO
  5. Mixture-of-Scores: Robust Image-Text Data Valuation via Three Lines of Code
  6. NVILA: Efficient Frontier Visual Language Models
  7. SEED-Story: Multimodal Long Story Generation with Large Language Model
  8. Scaling RL to Long Videos
    NeurIPS 2025 · Yukang Chen
  9. SparseVILA: Decoupling Visual Sparsity for Efficient VLM Inference
  10. TTS-VAR: A Test-Time Scaling Framework for Visual Auto-Regressive Generation
  11. VisionZip: Longer is Better but Not Necessary in Vision Language Models
  12. WorldModelBench: Judging Video Generation Models As World Models
  13. Denoising Diffusion Step-aware Models
  14. E2-LLM: Efficient and Extreme Length Extension of Large Language Models
  15. LISA: Reasoning Segmentation via Large Language Model
  16. LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
    ICLR 2024 · Yukang Chen
  17. Low-Rank Approximation for Sparse Attention in Multi-Modal LLMs
  18. MR-Ben: A Meta-Reasoning Benchmark for Evaluating System-2 Thinking in LLMs
  19. OA-CNNs: Omni-Adaptive Sparse CNNs for 3D Semantic Segmentation
  20. RL-GPT: Integrating Reinforcement Learning and Code-as-policy
  21. SaCo Loss: Sample-Wise Affinity Consistency for Vision-Language Pre-Training