
Who Defines “Best”? Towards Interactive, User-Defined Evaluation of LLM Leaderboards
- Minji Jung, Minjae Lee, Yejin Kim, Sarang Choi, Minsuk Kahng
ACM Conference on Fairness, Accountability, and Transparency (FAccT 2026)
Data-Prompt Co-Evolution: Growing Test Sets to Refine LLM Behavior
- Minjae Lee, Minsuk Kahng
ACM CHI Conference on Human Factors in Computing Systems (CHI 2026)
When Cars Have Stereotypes: Auditing Demographic Bias in Objects from Text-to-Image Models
- Dasol Choi, Jihwan Lee, Minjae Lee, Minsuk Kahng
arXiv