PPaperPicks

Jinsong Su

51 papers at tracked venues · 35 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Augmenting Intra-Modal Understanding in MLLMs for Robust Multimodal Keyphrase Generation
  2. BAPO: Boundary-Aware Policy Optimization for Reliable Agentic Search
  3. Beyond Black-Box Interventions: Latent Probing for Faithful Retrieval-Augmented Generation
  4. Beyond Passive Critical Thinking: Fostering Proactive Questioning to Enhance Human-AI Collaboration
  5. CEMT: Controllable Element-Oriented Machine Translation via Structured Linguistic Reasoning
  6. CNSL-bench: Benchmarking the Sign Language Understanding Capabilities of MLLMs on Chinese National Sign Language
  7. DetectRL-X: Towards Reliable Multilingual and Real-World LLM-Generated Text Detection
  8. GIFT: Guided Fine-Tuning and Transfer for Enhancing Instruction-Tuned Language Models
  9. HCRE: LLM-based Hierarchical Classification for Cross-Document Relation Extraction with a Prediction-then-Verification Strategy
  10. HEALing Entropy Collapse: Enhancing Exploration in Few-Shot RLVR via Hybrid-Domain Entropy Dynamics Alignment
  11. LegalGraphRAG: Multi-Agent Graph Retrieval-Augmented Generation for Reliable Legal Reasoning
  12. Orchestrating Tokens and Sequences: Dynamic Hybrid Policy Optimization for RLVR
  13. PLaST: Towards Paralinguistic-aware Speech Translation
  14. Selective Contrastive Learning For Gloss Free Sign Language Translation
  15. A Multi-Agent Framework with Automated Decision Rule Optimization for Cross-Domain Misinformation Detection
  16. A Self-Denoising Model for Robust Few-Shot Relation Extraction
  17. AVG-LLaVA: An Efficient Large Multimodal Model with Adaptive Visual Granularity
  18. Advancing SMoE for Continuous Domain Adaptation of MLLMs: Adaptive Router and Domain-Specific Loss
  19. An Evaluation Resource for Grounding Translation Errors
  20. Boosting Visual Knowledge-Intensive Training for LVLMs Through Causality-Driven Visual Object Completion
  21. Don't Get Lost in the Trees: Streamlining LLM Reasoning by Overcoming Tree Search Exploration Pitfalls
  22. EditEval: Towards Comprehensive and Automatic Evaluation for Text-guided Video Editing
  23. EpiCoder: Encompassing Diversity and Complexity in Code Generation
  24. FaithfulRAG: Fact-Level Conflict Modeling for Context-Faithful Retrieval-Augmented Generation
  25. Gloss Matters: Unlocking the Potential of Non-Autoregressive Sign Language Translation
  26. Investigating Inference-time Scaling for Chain of Multi-modal Thought: A Preliminary Study
  27. LLM-OREF: An Open Relation Extraction Framework Based on Large Language Models
  28. LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning
  29. LiteSearch: Efficient Tree Search with Dynamic Exploration Budget for Math Reasoning
  30. Locate-and-Focus: Enhancing Terminology Translation in Speech Language Models
  31. PATIMT-Bench: A Multi-Scenario Benchmark for Position-Aware Text Image Machine Translation in Large Vision-Language Models
  32. Revolutionizing Database Q&A with Large Language Models: Comprehensive Benchmark and Evaluation
  33. TempParaphraser: "Heating Up" Text to Evade AI-Text Detection through Paraphrasing
  34. A Learning Rate Path Switching Training Paradigm for Version Updates of Large Language Models
  35. Conditional Variational Autoencoder for Sign Language Translation with Cross-Modal Alignment
  36. Efficient k-Nearest-Neighbor Machine Translation with Dynamic Retrieval
  37. Empowering Backbone Models for Visual Text Generation with Input Granularity Control and Glyph-Aware Training
  38. Improving LLM Generations via Fine-Grained Self-Endorsement
  39. Lightweight Transformer for sEMG Gesture Recognition with Feature Distilled Variational Information Bottleneck
  40. Mitigating Catastrophic Forgetting in Large Language Models with Self-Synthesized Rehearsal
  41. Multi-Level Cross-Modal Alignment for Speech Relation Extraction
  42. On the Cultural Gap in Text-to-Image Generation
  43. One2Set + Large Language Model: Best Partners for Keyphrase Generation
  44. Response Enhanced Semi-supervised Dialogue Query Generation
  45. Retaining Key Information under High Compression Ratios: Query-Guided Compressor for LLMs
  46. Self-Consistency Boosts Calibration for Math Reasoning
  47. Signer Diversity-driven Data Augmentation for Signer-Independent Sign Language Translation
  48. Towards Better Graph-based Cross-document Relation Extraction via Non-bridge Entity Enhancement and Prediction Debiasing
  49. Translatotron-V(ison): An End-to-End Model for In-Image Machine Translation
  50. Using Large Language Model for End-to-End Chinese ASR and NER
  51. Who To Align With: Feedback-Oriented Multi-Modal Alignment in Recommendation Systems