로봇이 버튼을 '안다'는 것은 무엇을 뜻하는가

김동현 기자 · 입력 2026.09.26 05:53
GIST의 부품·기능 인식 기술이 던지는 질문
기사 대표 이미지
광주과학기술원(GIST) 광주과학기술원(GIST) 중앙도서관 정문(기관 로고 표지판 포함) (사진 출처=Wikimedia Commons·Wiki.blurbs, CC BY-SA 4.0)

로봇이 전자레인지 앞에 섰다고 하자. “이것은 전자레인지다”라고 아는 것과, 어느 버튼을 눌러야 문이 열리고 어느 다이얼을 돌려야 시간이 맞춰지는지 아는 것은 전혀 다른 차원의 문제다. 광주과학기술원(GIST) 김의환 교수 연구팀이 유럽컴퓨터비전학회(ECCV) 2026에서 발표한 OP3DSG는 이 간극을 정면으로 겨냥한 기술이다. 물체 전체를 하나의 덩어리로 인식하던 기존 로봇 시각을, 손잡이·버튼 같은 세부 부품 단위로 쪼개고 그 부품이 어떤 기능을 하는지까지 읽어내는 수준으로 끌어올렸다. 나는 이 연구를 단순한 인식 성능의 개선이 아니라, 로봇이 ‘보는 존재’에서 ‘다루는 존재’로 넘어가는 문턱에 선 사례로 읽는다.

왜 지금 ‘부품과 기능’인가

컴퓨터 비전 분야에서 3차원 장면 그래프(scene graph, 물체와 물체 사이의 관계를 점과 선으로 표현해 장면 전체를 하나의 지도처럼 나타내는 기법)는 최근 몇 년 사이 로봇공학의 핵심 화두로 떠올랐다. 처음에는 “방 안에 냉장고가 있고 그 옆에 식탁이 있다”는 식으로 물체 간 배치를 파악하는 수준이었다면, 최근 흐름은 한 걸음 더 들어가 개별 물체 내부의 구조까지 파고드는 쪽으로 옮겨가고 있다. 이는 심리학에서 나온 행동유도성(affordance, 어떤 사물의 형태나 구조가 그것을 어떻게 다뤄야 하는지를 스스로 암시한다는 개념)이라는 개념이 로봇공학에 본격적으로 접목되는 과정과 맞닿아 있다. 사람은 처음 보는 전자레인지 앞에서도 버튼의 생김새만으로 그것이 눌러야 하는 것임을 직관적으로 안다. 로봇에게 이 직관을 수치와 구조로 심어주는 일이야말로 최근 로봇 시각 연구가 씨름해온 난제였고, OP3DSG는 그 씨름의 한 결실이라고 나는 본다.

남은 과제

다만 반가움과 별개로 짚어야 할 지점도 있다. 실험실에서 검증된 부품 인식 능력이 실제 가정의 무수히 다른 제품 디자인 앞에서도 일관되게 작동할지는 아직 열린 문제다. 제조사마다 버튼의 모양과 배치, 재질이 제각각인 현실에서 이런 기술이 진짜 쓸모를 가지려면 다양한 제품군에 대한 방대한 데이터와 지속적인 검증이 뒤따라야 한다고 본다. 그럼에도 이번 성과는 국내 로봇 연구가 완제품 수입 기술에 기대지 않고 인식·조작의 원천 기술을 스스로 확보하려는 흐름 위에 있다는 점에서 의미가 작지 않다. 가정용·돌봄 로봇 상용화를 목표로 하는 국내 산업계가 이런 대학발 원천기술에 더 일찍, 더 적극적으로 손을 내밀어야 할 때라고 나는 생각한다.

저작권자 © 한국R&D신문 — 무단 전재 및 재배포 금지
김동현 기자 dh.kim@k-rnd.net
전자·AI·소프트웨어 — 전자회로·통신·임베디드, 생성형 AI·머신러닝·데이터
댓글 0 최신순 추천순

첫 댓글을 남겨보세요.

0 / 400 · 회원 로그인 시 닉네임으로 작성 · 비회원 수정은 작성 후 1분 이내