Professional Experience

Research Intern, EXAONE Lab

June 2026 – Present
LG AI Research
Multimodal foundation-model training, visual code generation, and synthetic trajectory data for interactive environments.

Research Intern, Voice Tech

Dec 2025 – June 2026
NAVER Cloud
Developed a robust multilingual G2P model for noisy, non-standard inputs; built a G2P benchmark for non-canonical words across KO, EN, and VI; analyzed user corpora to identify failure modes in standard G2P systems.

Research Assistant, Multimodal AI Lab

Sep 2024 – Aug 2026
Hanyang University
Multimodal learning across dense video captioning, text-video retrieval, and retrieval-augmented learning; industrial research with Piaspace on automated highlight extraction.

Undergraduate Research Intern, Multimodal AI Lab

Mar 2023 – Aug 2024
Hanyang University
Early research in vision-language learning.

Education

M.S. in Data Science

Sep 2024 – Aug 2026
Hanyang University
Advisor: Dong-Jin Kim.

B.S. in Industrial Engineering & Big Data Science (Double Major)

2020 – 2024
Hanyang University
Seoul, South Korea.

Summary

AI researcher working on data-centric training for multimodal and language models. My work spans training and post-training data design (curation, synthetic data generation, retrieval-augmented learning), multimodal understanding, multilingual language and speech modeling, and agentic visual-code environments.

📄 Download full résumé (PDF) · Portfolio (PDF)

Skills

  • Programming Languages: Python, C++, SQL, Java, LaTeX
  • Frameworks & Libraries: PyTorch, CUDA, FAISS
  • Tools & DevOps: Git, Docker, Linux
  • Research Interests: Multimodal & Language Models, Foundation-Model Training and Post-training, Data-Centric AI, Agentic AI

Selected Publications

  • Phonemizing User-Generated Text: A Benchmark, Taxonomy, and Compositional Approach, EMNLP 2026 (Findings, Long)
  • Sali4Vid: Saliency-Aware Video Reweighting and Adaptive Caption Retrieval for Dense Video Captioning, EMNLP 2025 (Long, Main)
  • Cap4Bridge: Caption-Guided Cross-Modal Contextualization with Stochastic Augmentation for Text-Video Retrieval, IEEE Access 2026
  • Follow the Saliency: Supervised Saliency for Retrieval-augmented Dense Video Captioning, CVPR 2026
  • SAIL: Similarity-Aware Guidance and Inter-Caption Augmentation-based Learning for Weakly-Supervised DVC, CVPR 2026
  • SynC: Synthetic Image Caption Dataset Refinement with One-to-many Mapping for Zero-shot Image Captioning, ACM MM 2025
  • Time-aware Video Frame Reweighting and Captioning Tool, Patent, Reg. No. C-2025-058417

Awards

  • Best Paper Award (Bronze), IEIE Summer Annual Conference, 2025
  • Outstanding Poster Presentation Award, IEIE Summer Annual Conference, 2024
  • Bronze Prize, DACON AI Competition (Mandarin Orange Yield Prediction), 2022

References

  • Dong-Jin Kim, Thesis Advisor. Assistant Professor, Department of Data Science, Hanyang University. Email: djdkim@hanyang.ac.kr