Publications
Publications
2026
MENTOR: A Reinforcement Learning Framework for Enabling Tool Use in Small Models via Teacher-Optimized Rewards
ChangSu Choi*, Hoyun Song*, Dongyeon Kim, WooHyeon Jung, Minkyung Cho, Sunjin Park, NohHyeob Bae, Seona Yu, and KyungTae Lim
EMNLP 2026 [Accepted] [paper]
Hidden Threat in Synthetic Data: Covert Targeted Bias Injection through Benign Text
Minkyung Cho, Jihyo Kim, SeungWoo Song, Junghun Yuk, Minjoon Kee, Hoyun Song† , and KyungTae Lim†
EMNLP 2026 [Accepted] [paper]
Which Language Should a Skeleton Speak? Language Choices in Multilingual Reasoning
HyeonSeok Lim, SeungWoo Song, Inho Won, Hoyun Song, Jihyo Kim, and KyungTae Lim
Findings of EMNLP 2026 [Accepted]
STEERLSN: Training-Free Representation Alignment through Language-Specific Neuron Subspace Interpolation
Minjun Kim, Dongyeon Kim, Hoyun Song, Jihyo Kim, and KyungTae Lim
Findings of AACL 2026 [Accepted]
Semantic Hardness Is Not Visual Hardness: Sign-Aware Hard Negative Mining for Sign Language Retrieval
Junmyeong Lee, Chan Hur, ChangSu Choi, Sukmin Cho, Fitsum Gaim, Eui Jun Hwang, Hoyun Song† , and KyungTae Lim†
ACL 2026 [paper]
Beyond Static Benchmarks: Synthesizing Harmful Content via Persona-based Simulation for Robust Evaluation
Huije Lee, Jisu Shin, Hoyun Song, Changgeon Ko, and Jong C. Park
ACL 2026 [paper]
Social Dynamics as Critical Vulnerabilities that Undermine Objective Decision-Making in LLM Collectives
Changgeon Ko, Jisu Shin, Hoyun Song, Huije Lee, Eui Jun Hwang, and Jong C. Park
ACL 2026 [paper]
RoleConflictBench: A Benchmark of Role Conflict Scenarios for Evaluating LLMs' Contextual Sensitivity
Jisu Shin, Hoyun Song, Juhyun Oh, Changgeon Ko, Eunsu Kim, Chani Jung, and Alice Oh
Findings of ACL 2026 [paper]
TReX: Tokenizer Regression for Optimal Data Mixture
Inho Won, Hangyeol Yoo, Minkyung Cho, Jungyeul Park, Hoyun Song† , and KyungTae Lim†
EACL 2026 [paper]
MENTALBENCH: A Benchmark for Evaluating Psychiatric Diagnostic Capability of Large Language Models
Hoyun Song*, Migyeong Kang*, Jisu Shin, Jihyun Kim, Chanbi Park, Hangyeol Yoo, Jihyun An, Alice Oh, Jinyoung Han, and KyungTae Lim
Under Review [paper]
2025
A Multi-Task Benchmark for Abusive Language Detection in Low-Resource Settings
Fitsum Gaim, Hoyun Song, Huije Lee, Changgeon Ko, Eui Jun Hwang, and Jong C. Park
NeurIPS 2025 Datasets and Benchmarks Track [paper]
Does Rationale Quality Matter? Enhancing Mental Disorder Detection via Selective Reasoning Distillation
Hoyun Song, Huije Lee, Jisu Shin, Sukmin Cho, Changgeon Ko, and Jong C. Park
Findings of ACL 2025 [paper]
Spotting Out-of-Character Behavior: Atomic-Level Evaluation of Persona Fidelity in Open-Ended Generation
Jisu Shin, Juhyun Oh, Eunsu Kim, Hoyun Song, and Alice Oh
Findings of ACL 2025 [paper]
EXIT: Context-Aware Extractive Compression for Enhancing Retrieval-Augmented Generation
Taeho Hwang, Sukmin Cho, Soyeong Jeong, Hoyun Song, SeungYoon Han, and Jong C. Park
Findings of ACL 2025 [paper]
Temporal Information Retrieval via Time-Specifier Model Merging
SeungYoon Han, Taeho Hwang, Sukmin Cho, Soyeong Jeong, Hoyun Song, Huije Lee, and Jong C. Park
KnowFM@ACL 2025
Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding
Sukmin Cho, Sangjin Choi, Taeho Hwang, Jeongyeon Seo, Soyeong Jeong, Huije Lee, Hoyun Song, Jong C. Park, and Youngjin Kwon
Findings of NAACL 2025 [paper]
KORMo: Korean Open Reasoning Model for Everyone
Minjun Kim, Hyeonseok Lim, Hangyeol Yoo, Inho Won, Seungwoo Song, Minkyung Cho, Junhun Yuk, Changsu Choi, Dongjae Shin, Huije Lee, Hoyun Song, Alice Oh, and KyungTae Lim
arXiv [paper]
2024
Different Bias Under Different Criteria: Assessing Bias in LLMs with a Fact-Based Approach
Changgeon Ko, Jisu Shin, Hoyun Song, Jeongyeon Seo, and Jong C. Park
SoLaR@NeurIPS 2024 [paper]
Towards Effective Counter-Responses: Aligning Human Preferences with Strategies to Combat Online Trolling
Huije Lee, Hoyun Song, Jisu Shin, Sukmin Cho, Seungyoon Han, and Jong C. Park
Findings of EMNLP 2024 [paper]
Ask LLMs Directly, "What shapes your bias?": Measuring Social Bias in Large Language Models
Jisu Shin, Hoyun Song, Huije Lee, Soyeong Jeong, and Jong C. Park
Findings of ACL 2024 [paper]
2023
Generation of Korean Offensive Language by Leveraging Large Language Models via Prompt Design
Jisu Shin, Hoyun Song, Huije Lee, Fitsum Gaim, and Jong C. Park
AACL 2023 [paper]
A Simple and Flexible Modeling for Mental Disorder Detection by Learning from Clinical Questionnaires
Hoyun Song, Jisu Shin, Huije Lee, and Jong C. Park
ACL 2023 [paper]
2022
ELF22: A Context-based Counter-Trolling Dataset to Combat Internet Trolls
Huije Lee, Young Ju Na, Hoyun Song, Jisu Shin, and Jong C. Park
LREC 2022 [paper]
2021
A Large-scale Comprehensive Abusiveness Detection Dataset with Multifaceted Labels from Reddit
Hoyun Song*, Soo Hyun Ryu*, Huije Lee, and Jong C. Park
Optimizing Domain Specificity of Transformer-based Language Models for Extractive Summarization of Financial News Articles in Korean
Huije Lee, Wonsuk Yang, ChaeHun Park, Hoyun Song, Eugene Jang, and Jong C. Park
PACLIC 2021 [paper]
2018
Feature Attention Network: Interpretable Depression Detection from Social Media
Hoyun Song*, Jinseon You*, Jin-Woo Chung, and Jong C. Park
PACLIC 2018 [paper]