Curriculum Vitae
Academic and professional history.
Professional Experience
Research Intern, EXAONE Lab
June 2026 – Present LG AI Research
Multimodal foundation-model training, visual code generation, and synthetic trajectory data for interactive environments.
Research Intern, Voice Tech
Dec 2025 – June 2026 NAVER Cloud
Developed a robust multilingual G2P model for noisy, non-standard inputs; built a G2P benchmark for non-canonical words across KO, EN, and VI; analyzed user corpora to identify failure modes in standard G2P systems.
Research Assistant, Multimodal AI Lab
Sep 2024 – Aug 2026 Hanyang University
Multimodal learning across dense video captioning, text-video retrieval, and retrieval-augmented learning; industrial research with Piaspace on automated highlight extraction.
Undergraduate Research Intern, Multimodal AI Lab
Mar 2023 – Aug 2024 Hanyang University
Early research in vision-language learning.
Education
M.S. in Data Science
Sep 2024 – Aug 2026 Hanyang University
Advisor: Dong-Jin Kim.
B.S. in Industrial Engineering & Big Data Science (Double Major)
2020 – 2024 Hanyang University
Seoul, South Korea.
Summary
AI researcher working on data-centric training for multimodal and language models. My work spans training and post-training data design (curation, synthetic data generation, retrieval-augmented learning), multimodal understanding, multilingual language and speech modeling, and agentic visual-code environments.
📄 Download full résumé (PDF) · Portfolio (PDF)
Skills
- Programming Languages: Python, C++, SQL, Java, LaTeX
- Frameworks & Libraries: PyTorch, CUDA, FAISS
- Tools & DevOps: Git, Docker, Linux
- Research Interests: Multimodal & Language Models, Foundation-Model Training and Post-training, Data-Centric AI, Agentic AI
Selected Publications
- Phonemizing User-Generated Text: A Benchmark, Taxonomy, and Compositional Approach, EMNLP 2026 (Findings, Long)
- Sali4Vid: Saliency-Aware Video Reweighting and Adaptive Caption Retrieval for Dense Video Captioning, EMNLP 2025 (Long, Main)
- Cap4Bridge: Caption-Guided Cross-Modal Contextualization with Stochastic Augmentation for Text-Video Retrieval, IEEE Access 2026
- Follow the Saliency: Supervised Saliency for Retrieval-augmented Dense Video Captioning, CVPR 2026
- SAIL: Similarity-Aware Guidance and Inter-Caption Augmentation-based Learning for Weakly-Supervised DVC, CVPR 2026
- SynC: Synthetic Image Caption Dataset Refinement with One-to-many Mapping for Zero-shot Image Captioning, ACM MM 2025
- Time-aware Video Frame Reweighting and Captioning Tool, Patent, Reg. No. C-2025-058417
Awards
- Best Paper Award (Bronze), IEIE Summer Annual Conference, 2025
- Outstanding Poster Presentation Award, IEIE Summer Annual Conference, 2024
- Bronze Prize, DACON AI Competition (Mandarin Orange Yield Prediction), 2022
References
- Dong-Jin Kim, Thesis Advisor. Assistant Professor, Department of Data Science, Hanyang University. Email: djdkim@hanyang.ac.kr