Publications

⚡ = oral / spotlight / award · * equal contribution · † corresponding author

Selected publications · LLM post-training & self-improvement

Transferability for General Reasoning: An Automated Curriculum for Multi-Domain RLVR

Yongjin Yang, Jiarui Liu, Yinghui He, Lechen Zhang, Bernhard Schölkopf, Zhijing Jin†

Preprint · ICML 2026 RLxF Workshop (Oral, Top 4 Best Papers out of 222 submissions)

Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback

Yongjin Yang*, Sinjae Kang*, Juyong Lee, Dongjun Lee, Se-Young Yun†, Kimin Lee†

Preprint

Making Complex Reasoning Student-Friendly: A Hybrid Distillation Framework for Small Language Models

Yongjin Yang, Yinghui He, Jiarui Liu, Zhijing Jin

Scaling Post-training for LLMs Workshop @ ICLR 2026

LLM-as-a-Tutor: Policy-Aware Prompt Adaptation for Non-Verifiable RL

Yujin Kim*, Namgyu Ho*, Sangmin Hwang*, Joonkee Kim, Yongjin Yang, Sangmin Bae, Seungone Kim, Jaehun Jung, Se-Young Yun†, Hwanjun Song†

Preprint

Self-Distillation Zero: Self-Revision Turns Binary Rewards into Dense Supervision

Yinghui He, Simran Kaur, Adithya Bhaskar, Yongjin Yang, Jiarui Liu, Narutatsu Ri, Liam Fowl, Abhishek Panigrahi, Danqi Chen, Sanjeev Arora

Preprint · ICML 2026 RLxF Workshop (Oral, Top 4 Best Papers)

Entropy-Aware On-Policy Distillation of Language Models

Woogyeol Jin, Taywon Min, Yongjin Yang, Dennis Wei, Yi Zhou, Swanand Ravindra Kadhe, Nathalie Baracaldo, Kimin Lee

ICML 2026

MixSD: Mixed Contextual Self-Distillation for Knowledge Injection

Jiarui Liu, Lechen Zhang, Yongjin Yang, Yinghui He, Yingheng Wang, Weihao Xuan, Zhijing Jin, Mona T. Diab

Preprint

Revisiting Multi-Agent Debate as Test-Time Scaling: A Systematic Study of Conditional Effectiveness

Yongjin Yang*, Euiin Yi*, Jongwoo Ko, Kimin Lee†, Zhijing Jin†, Se-Young Yun†

Preprint · ICML 2025 MAS Workshop

Additional publications

CORE: Measuring Multi-Agent LLM Interaction Quality under Game-Theoretic Pressures

Punya Syon Pandey, Yongjin Yang, Jiarui Liu, Zhijing Jin

EACL 2026 Main

The Wedge Questions: Latent Cultural Boundaries in LLMs via Persona Projection Divergence

Yejin Son, Yongjin Yang, Ryan Faulkner, Matt Ratto, Seungwon Lim, Youngjae Yu, Zhijing Jin

Preprint · ICML 2026 Pluralistic Alignment Workshop

UniSAFE: A Comprehensive Benchmark for Safety Evaluation of Unified Multimodal Models

Segyu Lee*, Boryeong Cho*, Hojung Jung*, Seokhyun An, Juhyeong Kim, Jaehyun Kwak, Yongjin Yang, Sangwon Jang, Youngrok Park, Wonjun Chang, Se-Young Yun

Preprint

Agent-to-Agent Theory of Mind: Testing Interlocutor Awareness among Large Language Models

Younwoo Choi*, Changling Li*, Yongjin Yang, Zhijing Jin

EMNLP 2025 Main

Corrupted by Reasoning: Reasoning Language Models Become Free-Riders in Public Goods Games

David Guzman Piedrahita, Yongjin Yang, Mrinmaya Sachan, Giorgia Ramponi, Bernhard Schölkopf, Zhijing Jin

COLM 2025 · ACL 2025 REALM Workshop (Oral)

Self-Training Elicits Concise Reasoning in Large Language Models

Tergel Munkhbat*, Namgyu Ho*, Seo Hyun Kim*, Yongjin Yang, Yujin Kim, Se-Young Yun

ACL 2025 Findings

Code-Switching Red-Teaming: LLM Evaluation for Safety and Multilingual Understanding

Haneul Yoo, Yongjin Yang, Hwaran Lee

ACL 2025 Main · NeurIPS 2024 Red Teaming GenAI Workshop

Automated Filtering of Human Feedback Data for Aligning Text-to-Image Diffusion Models

Yongjin Yang*, Sihyeon Kim*, Hojung Jung, Sangmin Bae, SangMook Kim, Se-Young Yun†, Kimin Lee†

ICLR 2025

MAQA: Evaluating Uncertainty Quantification in LLMs Regarding Data Uncertainty

Yongjin Yang, Haneul Yoo, Hwaran Lee

NAACL 2025 Findings

Towards Difficulty-Agnostic Efficient Transfer Learning for Vision-Language Models

Yongjin Yang*, Jongwoo Ko*, Se-Young Yun

EMNLP 2024 Main

Towards Unbiased Evaluation of Detecting Unanswerable Questions in EHRSQL

Yongjin Yang*, Sihyeon Kim*, SangMook Kim*, Gyubok Lee, Se-Young Yun, Edward Choi

DPFM Workshop @ ICLR 2024

Leveraging Normalization Layer in Adapters with Progressive Learning and Adaptive Distillation for Cross-Domain Few-Shot Learning

Yongjin Yang, Taehyeon Kim, Se-Young Yun

AAAI 2024

HARE: Explainable Hate Speech Detection with Step-by-Step Reasoning

Yongjin Yang*, Joonkee Kim*, Yujin Kim*, Namgyu Ho, James Thorne†, Se-Young Yun†

EMNLP 2023 Findings

Meta-Learning with Adaptive Weighted Loss for Imbalanced Cold-Start Recommendation

Minchang Kim*, Yongjin Yang*, Jung Hyun Ryu, Taesup Kim

CIKM 2023 (Oral)