I am a Research engineer at RLWRLD.
Before joining the team, I held a postdoctoral research position in Inria Grenoble-Rhône-Alpes THOTH team advised by Karteek Alahari, following the completion of my Ph.D at POSTECH computer vision lab under the supervision of prof. Minsu Cho.
My current research interest is low-level policies for robotic manipulation, especially World Action Models (WAM) and Vision-Language Action (VLA) models.
Publication
- PointWAM: 3D World Action Modeling for Dexterous Robotic Manipulation [Project page] [code]
Chunghyun Park(*), Beomjun Kim(*) Seungcheol Park(†) Heeseung Kwon(†), Yashu Shukla, Seunghoon Sim, Jinwoo Shin, Minsu Cho, (* co-first authors, † equal contribution) In ICLR 2027 (under review)
- Exploring Multi-order Self-Similarity for Motion Understanding [code]
Manjin Kim(*), Heeseung Kwon(*), Karteek Alahari, Minsu Cho, (* equal contribution) In NeurIPS 2026
- RLDX-1 Technical Report [Project page] [code]
Dongyoung Kim(†§), Huiwon Jang(†§), Myungkyu Koo(†), Suhyeok Jang(†), Taeyoung Kim(†), Beomjun Kim, Byungjun Yoon, Changsung Jang, Daewon Choi, Dongsu Han, Donguk Lee, Heeseung Kwon,
Hojin Jeon, Jaehyun Kang, Jaekyoung Bae, Jihyuk Lee, Jimin Lee, John Won, Joonwoo Ahn, Junhyeong Park, Junyoung Sung, Kyungmin Lee, Minseong Han, Minsung Yoon, Sejune Joo,
Seonil Son, Seungcheol Park, Seunggeun Cho, Seungjun Moon, Seungku Kim, Yonghoon Dong, Yongjin Cho, Youngchan Kim, Jinwoo Shin(§), († project leads, § research leads) *In *arXiv 2026
- ContextVLA: Vision-Language-Action Model with Amortized Multi-frame Context [code]
Huiwon Jang, Sihyun Yu, Heeseung Kwon, Hojin Jeon, Younggyo Seo(*), Jinwoo Shin(*), (* equal contribution) In arXiv 2025
- Lightweight Structure-Aware Attention for Visual Undestanding [code]
Heeseung Kwon, Francisco M. Castro, Manuel J. Marin-Jimenez, Nicolas Guil, Karteek Alahari, In IJCV 2025
- Relational Self-Attention: What’s missing in Attention for Video Understanding [Project page] [code]
Manjin Kim(*), Heeseung Kwon(*), Chungyu Wang, Suha Kwak, Minsu Cho (* equal contribution), In NeurIPS 2021
- Relational Embedding for Few-shot Classification [Project page] [code]
Dahyun Kang, Heeseung Kwon, Juhong Min, Minsu Cho, In ICCV 2021
- Learning Self-Similarity in Space and Time as Generalized Motion for Video Action Recognition [Project page] [code]
Heeseung Kwon(*), Manjin Kim(*), Suha Kwak, Minsu Cho (* equal contribution), In ICCV 2021
- IntegralAction: Pose-driven Feature Integration for Robust Human Action Recognition in Videos [code]
Gyeongsik Moon(*), Heeseung Kwon(*), Kyoung Mu Lee, Minsu Cho (* equal contribution), CVPR Workshop 2021
- MotionSqueeze: Neural Motion Feature Learning for Video Understanding [Project page] [code]
Heeseung Kwon, Manjin Kim, Suha Kwak, Minsu Cho, In ECCV 2020
- Temporal U-Nets for Video Summarization with Scene and Action Recognition
Heeseung Kwon, Woohyun Shim, Minsu Cho, In ICCV Workshop 2019 (Challenge winner as the 2nd place of CoVieW 2019)
- Video Understanding via Convolutional Temporal Pooling Network and Multimodal Feature Fusion
Heeseung Kwon, Suha Kwak, Minsu Cho, In MM Workshop 2019 (Challenge winner as the 1st place of CoVieW 2018)
- First Person Action Recognition via Two-stream ConvNet with Long-term Fusion Pooling
Heeseung Kwon, Yeonho Kim, Jin S. Lee, Minsu Cho, In PRL 2018
Education