핵심 요약
슈퍼브에이아이가 로봇 눈의 진화를 목표로 'K-엑사원 데이터 공장'을 가동하여 대규모 데이터 파이프라인과 RGB-D/3D 카메라 기반 비전, Vision-Language-Action 모듈 등을 통해 로봇 시각 인지 체계의 성능 확장을 시도하고 있다.
구현 방법
- 대규모 데이터 공장 설계 및 운영으로 데이터 수집/정제/라벨링 파이프라인 구축
- RGB-D 영상 및 3D 카메라를 활용한 다중 모달 비전 시스템 구현
- Vision-Language-Action(VLA) 모듈을 통한 시각-언어-행동 연계 연구
- LG AI 연구원과의 협력 및 시뮬레이션-현장 평가 병행
- sim-to-real gap 완화를 위한 데이터 보강 및 체계적 평가
주요 결과
- 대규모 데이터 확보로 학습 효율성 및 모델 개발 속도 향상
- 로봇 눈 인지 정확도 및 실시간 처리 성능 개선
- 시뮬레이션과 현실 환경 간 차이 축소에 따른 현장 적용 가능성 증가



