PPaperPicks

Xi Chen

56 papers at tracked venues · 37 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. ActorMind: Emulating Human Actor Reasoning for Speech Role-Playing
    ACL 2026 · Xi Chen
  2. ByteHouse: ByteDance's Cloud-Native Data Warehouse for Real-Time Multimodal Data Analytics
  3. How Does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse Autoencoding
    AAAI 2026 · Xi Chen
  4. SASST: Leveraging Syntax-Aware Chunking and LLMs for Simultaneous Speech Translation
  5. STELLA: A Multimodal LLM for Protein Functional Annotation via Unified Sequence-Structure Encoding
  6. Seeing Is Believing: Grounding Long-Video Understanding in Spatio-Temporal Visual Evidence
  7. Sparse Adapter Fusion for Continual Learning in NLP
  8. Topological Federated Clustering via Gravitational Potential Fields Under Local Differential Privacy
  9. What Makes an LLM a Good Optimizer? A Trajectory Analysis of LLM-Guided Evolutionary Search
  10. Ambiguity Awareness Optimization: Towards Semantic Disambiguation for Direct Preference Optimization
  11. Asynchronous Federated Clustering with Unknown Number of Clusters
  12. AttentionDrag: Exploiting Latent Correlation Knowledge in Pre-trained Diffusion Models for Image Editing
  13. ComPO: Preference Alignment via Comparison Oracles
  14. ConStyX: Content Style Augmentation for Generalizable Medical Image Segmentation
    MICCAI 2025 · Xi Chen
  15. Conan-Embedding-v2: Training an LLM from Scratch for Text Embeddings
  16. CryoGEN: Generative Energy-based Models for Cryogenic Electron Tomography Reconstruction
  17. Debate-Feedback: A Multi-Agent Framework for Efficient Legal Judgment Prediction
    NAACL 2025 · Xi Chen
  18. Decoupling Metacognition from Cognition: A Framework for Quantifying Metacognitive Ability in LLMs
  19. Disentangled Modeling of Preferences and Social Influence for Group Recommendation
  20. EIDT-V: Exploiting Intersections in Diffusion Trajectories for Model-Agnostic, Zero-Shot, Training-Free Text-to-Video Generation
  21. Embodied VideoAgent: Persistent Memory from Egocentric Videos and Embodied Sensors Enables Dynamic Scene Understanding
  22. Exploring the Impact of Personality Traits on LLM Bias and Toxicity
  23. Fira: Can We Achieve Full-rank Training of LLMs Under Low-rank Constraint?
    NeurIPS 2025 · Xi Chen
  24. HopRAG: Multi-Hop Reasoning for Logic-Aware Retrieval-Augmented Generation
  25. LongVPO: From Anchored Cues to Self-Reasoning for Long-Form Video Preference Optimization
  26. MotionStone: Decoupled Motion Intensity Modulation with Diffusion Transformer for Image-to-Video Generation
  27. OmniVCus: Feedforward Subject-driven Video Customization with Multimodal Control Conditions
  28. Online Video Understanding: OVBench and VideoChat-Online
  29. Pragmatic Inference Chain (PIC) Improving LLMs' Reasoning of Authentic Implicit Toxic Language
    EMNLP 2025 · Xi Chen
  30. Predicting Adolescent Suicidal Risk from Multi-task-based Speech: An Ensemble Learning Approach
    InterSpeech 2025 · Xi Chen
  31. Prototype Conditioned Generative Replay for Continual Learning in NLP
    NAACL 2025 · Xi Chen
  32. Reverse Region-to-Entity Annotation for Pixel-Level Visual Entity Linking
  33. Self-supervised Axial Super-Resolution for Volume Microscopy via Diffusion-Guided Structure Distillation
  34. Sheaf Discovery with Joint Computation Graph Pruning and Flexible Granularity
  35. TC-LLaVA: Rethinking the Transfer of LLava from Image to Video Understanding with Temporal Considerations
  36. Task-wrapped Continual Learning in Task-Oriented Dialogue Systems
  37. The Distributional Reward Critic Framework for Reinforcement Learning Under Perturbed Rewards
    AAAI 2025 · Xi Chen
  38. UniGraspTransformer: Simplified Policy Distillation for Scalable Dexterous Robotic Grasping
  39. Unleashing Diffusion Transformers for Visual Correspondence by Modulating Massive Activations
  40. VRoPE: Rotary Position Embedding for Video Large Language Models
  41. Zero-shot Denoising via Neural Compression: Theoretical and algorithmic framework
  42. Aligning and Restoring Imperfect ssEM Images for Continuity Reconstruction
  43. Bagged Deep Image Prior for Recovering Images in the Presence of Speckle Noise
    ICML 2024 · Xi Chen
  44. Beyond Read-Only: Crafting a Comprehensive Chinese Text-to-SQL Dataset for Database Manipulation and Query
    NAACL 2024 · Xi Chen
  45. Calibrated One Round Federated Learning with Bayesian Inference in the Predictive Space
  46. Exploiting Symmetric Temporally Sparse BPTT for Efficient RNN Training
    AAAI 2024 · Xi Chen
  47. Inductive Link Prediction for Sequential-emerging Knowledge Graph
  48. LLaST: Improved End-to-end Speech Translation System Leveraged by Large Language Models
    ACL 2024 · Xi Chen
  49. Open X-Embodiment: Robotic Learning Datasets and RT-X Models : Open X-Embodiment Collaboration
  50. PolyVoice: Language Models for Speech to Speech Translation
  51. Rethinking Generative Large Language Model Evaluation for Semantic Comprehension
  52. Self-supervised Preference Optimization: Enhance Your Language Model with Preference Degree Awareness
  53. Stylized Offline Reinforcement Learning: Extracting Diverse High-Quality Behaviors from Heterogeneous Datasets
  54. Understanding the Training Speedup from Sampling with Approximate Losses
  55. Untrained Neural Nets for Snapshot Compressive Imaging: Theory and Algorithms
  56. Wear-Any-Way: Manipulable Virtual Try-on via Sparse Correspondence Alignment