Publications

    2026

  • Disentangling Spurious Correlations in Vision-Language-Action Models via Predicting Domain-Invariant Latent Lookahead
    Junghyun Kim*, Ngseo Kim*, ChungWoo Lee, Seoyeon Lee, Woo-Jeong Baek, Adam Zhou, Chip Huyen, Jun-Ki Lee†, Gi-Cheon Kang†, Byoung-Tak Zhang†
    CoRL 2026

    Paper


  • MicroVLA: Edge-Deployable Vision Language Action at 10M Parameters
    Ngseo Kim, Junghyun Kim, Gi-Cheon Kang†, Youngjae Yu†, Byoung-Tak Zhang†
    RSS 2026 Workshop on L2P

    Paper


  • Can Embodied Agents Remember What You Said? Evaluating Dialogue-Grounded Embodied Memory in 3D Environments
    Seongjun Jeong, Junghyun Kim, Gi-Cheon Kang†, Byoung-Tak Zhang†
    CVPR 2026 Workshop on 3D-LLM/VLA

    Paper


  • 2025

  • Continual Vision-and-Language Navigation
    Seongjun Jeong, Gi-Cheon Kang, Seongho Choi, Joochan Kim, Byoung-Tak Zhang
    BMVC 2025

    Paper


  • CLIP-RT: Learning Language-Conditioned Robotic Policies from Natural Language Supervision
    Gi-Cheon Kang*, Junghyun Kim*, Kyuhwan Shim, Jun Ki Lee, Byoung-Tak Zhang
    RSS 2025 (Oral)

    Project Page Paper Code


  • Socratic Planner: Self-QA-Based Zero-Shot Planning for Embodied Instruction Following
    Suyeon Shin, Sujin Jeon*, Junghyun Kim*, Gi-Cheon Kang*, Byoung-Tak Zhang
    ICRA 2025

    Paper


  • 2024

  • PGA: Personalizing Grasping Agents with Single Human-Robot Interaction
    Junghyun Kim, Gi-Cheon Kang*, Jaein Kim*, Seoyoon Yang, Minjoon Jung, Byoung-Tak Zhang
    IROS 2024

    Paper Code


  • PROGrasp: Pragmatic Human-Robot Communication for Object Grasping
    Gi-Cheon Kang, Junghyun Kim, Jaein Kim, Byoung-Tak Zhang
    ICRA 2024 (Oral)

    Paper Code


  • 2023

  • The Dialog Must Go On: Improving Visual Dialog via Generative Self-Training
    Gi-Cheon Kang, Sungdong Kim*, Jin-Hwa Kim*, Donghyun Kwak*, Byoung-Tak Zhang
    CVPR 2023

    Paper Code


  • GVCCI: Lifelong Learning of Visual Grounding for Language-Guided Robotic Manipulation
    Junghyun Kim, Gi-Cheon Kang*, Jaein Kim*, Suyeon Shin, Byoung-Tak Zhang
    IROS 2023 (Oral)

    Paper Code


  • 2021

  • Reasoning Visual Dialog with Sparse Graph Learning and Knowledge Transfer
    Gi-Cheon Kang, Junseok Park, Hwaran Lee, Byoung-Tak Zhang*, Jin-Hwa Kim*
    EMNLP 2021 (Findings)

    Paper Code


  • Attend What You Need: Motion-Appearance Synergistic Networks for Video Question Answering
    Ahjeong Seo, Gi-Cheon Kang, Joonhan Park, Byoung-Tak Zhang
    ACL 2021

    Paper Code


  • 2020

  • Label Propagation Adaptive Resonance Theory for Semi-Supervised Continuous Learning
    Taehyeong Kim, Injune Hwang, Gi-Cheon Kang, Won-Seok Choi, Hyunseo Kim, Byoung-Tak Zhang
    ICASSP 2020

    Paper


  • 2019

  • Dual Attention Networks for Visual Reference Resolution in Visual Dialog
    Gi-Cheon Kang, Jaeseo Lim, Byoung-Tak Zhang
    EMNLP 2019

    Paper Code