Selected publications · LLM post-training & self-improvement
Transferability for General Reasoning: An Automated Curriculum for Multi-Domain RLVR ⚡
Yongjin Yang, Jiarui Liu, Yinghui He, Lechen Zhang, Bernhard Schölkopf, Zhijing Jin†
Preprint · ICML 2026 RLxF Workshop (Oral, Top 4 Best Papers out of 222 submissions)
Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback
Yongjin Yang*, Sinjae Kang*, Juyong Lee, Dongjun Lee, Se-Young Yun†, Kimin Lee†
Preprint
Making Complex Reasoning Student-Friendly: A Hybrid Distillation Framework for Small Language Models
Yongjin Yang, Yinghui He, Jiarui Liu, Zhijing Jin
Scaling Post-training for LLMs Workshop @ ICLR 2026
LLM-as-a-Tutor: Policy-Aware Prompt Adaptation for Non-Verifiable RL
Yujin Kim*, Namgyu Ho*, Sangmin Hwang*, Joonkee Kim, Yongjin Yang, Sangmin Bae, Seungone Kim, Jaehun Jung, Se-Young Yun†, Hwanjun Song†
Preprint
Self-Distillation Zero: Self-Revision Turns Binary Rewards into Dense Supervision ⚡
Yinghui He, Simran Kaur, Adithya Bhaskar, Yongjin Yang, Jiarui Liu, Narutatsu Ri, Liam Fowl, Abhishek Panigrahi, Danqi Chen, Sanjeev Arora
Preprint · ICML 2026 RLxF Workshop (Oral, Top 4 Best Papers)
Entropy-Aware On-Policy Distillation of Language Models
Woogyeol Jin, Taywon Min, Yongjin Yang, Dennis Wei, Yi Zhou, Swanand Ravindra Kadhe, Nathalie Baracaldo, Kimin Lee
ICML 2026
MixSD: Mixed Contextual Self-Distillation for Knowledge Injection
Jiarui Liu, Lechen Zhang, Yongjin Yang, Yinghui He, Yingheng Wang, Weihao Xuan, Zhijing Jin, Mona T. Diab
Preprint
Revisiting Multi-Agent Debate as Test-Time Scaling: A Systematic Study of Conditional Effectiveness
Yongjin Yang*, Euiin Yi*, Jongwoo Ko, Kimin Lee†, Zhijing Jin†, Se-Young Yun†
Preprint · ICML 2025 MAS Workshop
Additional publications
CORE: Measuring Multi-Agent LLM Interaction Quality under Game-Theoretic Pressures
Punya Syon Pandey, Yongjin Yang, Jiarui Liu, Zhijing Jin
EACL 2026 Main
The Wedge Questions: Latent Cultural Boundaries in LLMs via Persona Projection Divergence
Yejin Son, Yongjin Yang, Ryan Faulkner, Matt Ratto, Seungwon Lim, Youngjae Yu, Zhijing Jin
Preprint · ICML 2026 Pluralistic Alignment Workshop
UniSAFE: A Comprehensive Benchmark for Safety Evaluation of Unified Multimodal Models
Segyu Lee*, Boryeong Cho*, Hojung Jung*, Seokhyun An, Juhyeong Kim, Jaehyun Kwak, Yongjin Yang, Sangwon Jang, Youngrok Park, Wonjun Chang, Se-Young Yun
Preprint
Agent-to-Agent Theory of Mind: Testing Interlocutor Awareness among Large Language Models
Younwoo Choi*, Changling Li*, Yongjin Yang, Zhijing Jin
EMNLP 2025 Main
Corrupted by Reasoning: Reasoning Language Models Become Free-Riders in Public Goods Games ⚡
David Guzman Piedrahita, Yongjin Yang, Mrinmaya Sachan, Giorgia Ramponi, Bernhard Schölkopf, Zhijing Jin
COLM 2025 · ACL 2025 REALM Workshop (Oral)
Self-Training Elicits Concise Reasoning in Large Language Models
Tergel Munkhbat*, Namgyu Ho*, Seo Hyun Kim*, Yongjin Yang, Yujin Kim, Se-Young Yun
ACL 2025 Findings
Code-Switching Red-Teaming: LLM Evaluation for Safety and Multilingual Understanding
Haneul Yoo, Yongjin Yang, Hwaran Lee
ACL 2025 Main · NeurIPS 2024 Red Teaming GenAI Workshop
Automated Filtering of Human Feedback Data for Aligning Text-to-Image Diffusion Models ⚡
Yongjin Yang*, Sihyeon Kim*, Hojung Jung, Sangmin Bae, SangMook Kim, Se-Young Yun†, Kimin Lee†
ICLR 2025
MAQA: Evaluating Uncertainty Quantification in LLMs Regarding Data Uncertainty
Yongjin Yang, Haneul Yoo, Hwaran Lee
NAACL 2025 Findings
Towards Difficulty-Agnostic Efficient Transfer Learning for Vision-Language Models
Yongjin Yang*, Jongwoo Ko*, Se-Young Yun
EMNLP 2024 Main
Towards Unbiased Evaluation of Detecting Unanswerable Questions in EHRSQL
Yongjin Yang*, Sihyeon Kim*, SangMook Kim*, Gyubok Lee, Se-Young Yun, Edward Choi
DPFM Workshop @ ICLR 2024
Leveraging Normalization Layer in Adapters with Progressive Learning and Adaptive Distillation for Cross-Domain Few-Shot Learning
Yongjin Yang, Taehyeon Kim, Se-Young Yun
AAAI 2024
HARE: Explainable Hate Speech Detection with Step-by-Step Reasoning
Yongjin Yang*, Joonkee Kim*, Yujin Kim*, Namgyu Ho, James Thorne†, Se-Young Yun†
EMNLP 2023 Findings
Meta-Learning with Adaptive Weighted Loss for Imbalanced Cold-Start Recommendation ⚡
Minchang Kim*, Yongjin Yang*, Jung Hyun Ryu, Taesup Kim
CIKM 2023 (Oral)