Workshop Track
MetaSICL: Adapting Audiroty LLM via Meta Speech In-Context Learning
Haolong Zheng, Siyin Wang, Zengrui Jin, Mark A. Hasegawa-JohnsonParameter Alignment Mitigates Catastrophic Forgetting in Multilingual Expert Language Models
Sanchit Ahuja, Terra BlevinsEmpathy or Authenticity? Cross-Cultural Trade-offs in Persona-Designed LLM Support
Hanwen Cao, Arianna Liu, Shangyunqing Liu, Ziying ShenNormViz: A Benchmark and Framework for Grounding Multimodal Reasoning in Global Cultures
Akhila Yerukola, Fabrice Y Harel-Canada, Simran Khanuja, Abhinav Sukumar Rao, Ashima Suvarna, Nanyun Peng, Saadia Gabriel, Maarten SapInvestigating Social Bias in Narrative Image Generation
Junyeong Park, Sowon Min, Euna Jang, Soobin Kim, Jiho Jin, Hyunseung Lim, Gahyeon Bae, Hwajung HongMultilingual Reasoning Cascades Need More Context
Dengjia Zhang, Arnav Mazumder, Shuyue Stella Li, Yulia Tsvetkov, Niyati BafnaMoral Safety in LLMs: Exposing Performative Compliance with Puzzled Cues
Mohammadamin Shafiei, Shuyue Stella Li, Yulia TsvetkovThe Alignment Veto: How Safety Training Suppresses Cultural Knowledge in LLMs
Pardis Sadat Zahraei, Gokhan Tur, Dilek Hakkani-Tür, Ehsaneddin AsgariStructured Process Trajectories for Korean Text Deobfuscation and Toxicity Detection
Yechan Hwang, Eojin Joo, Chae-Gyun Lim, Geunhwa Jeong, Jinho Kim, Ho-Jin ChoiClash of Languages: Understanding Political Stance in LLMs Across Languages
Alfonso Amayuelas, Efstathios Siatras, Nikolas Belle, Dakota Barnes, Antonina Sinelnik, Ashay Srivastava, Drishti Sharma, Avneet Kaur, William Yang WangGlobeBench: Source-Grounded Evaluation of Local Geographic Assistance
Shreyas Krishnan, Arul Murugan, Abhishek NagarajJuICE: A Benchmark for Evaluating LLM-Judge in Identifying Cultural Errors
Jiho Jin, Junho Myung, Juhyun Oh, Junyeong Park, Rifki Afina Putri, Sunipa Dev, Vinodkumar Prabhakaran, Alice OhTerminal-Bench-LILT: An Agentic Coding Benchmark Grounded in Language, Region, and Culture
Yunsu Kim, Kaden Uhlig, Ashwin Purohit, Milind Agarwal, Patrick Simianer, Anıl Arslan, Kiarash Mokhtari, Thomas Zenkel, Johannes Mosig, Gabriel Bretschner, Shamik Bose, Joern Wuebker, John DeNeroDo Not Let English Judge the World: Protocol Sensitivity in Multilingual LLM-as-a-Judge Evaluation
Jingxu XieCan LLMs Recognize Sociocultural Context in Arabic Mental-Health Discourse? A Cross-Genre Evaluation of Questions and Social-Media Posts
Amal Abdullah Alqahtani