
비전언어행동모델 추론 속도 최대 7배 개선, GPU 없이 엣지 NPU에서 로봇 AI 구동
AI 최적화 전문기업 노타(NOTA)가 퀄컴의 산업용 AI 프로세서에서 로봇 AI 모델을 최적화해 실제 로봇 작업 속도를 크게 향상시켰다고 밝혔다. 회사는 이를 통해 피지컬 AI 환경에서 AI 모델과 반도체, 실행 환경을 아우르는 최적화 기술을 검증했다고 설명했다.
노타는 22일 퀄컴의 산업용 시스템온칩(SoC)인 ‘드래곤윙 IQ-9075’의 신경망처리장치(NPU)에서 비전언어행동모델(VLA)을 최적화한 결과, 로봇팔 작업 속도를 기존 대비 3배 높였다고 발표했다.
성능 검증은 로봇팔이 음성 명령에 따라 큐브를 집어 지정된 위치로 옮기는 작업을 대상으로 진행됐다. 실험 결과 AI 모델의 추론 속도는 최대 7배 향상됐으며, 실제 작업 시간은 기존 36초에서 12초 수준으로 단축됐다. 작업 성공률은 92%로, 원본 모델의 93%와 비교해 성능 저하를 최소화했다.
GPU 없이 엣지 NPU에서 AI 실행
이번 실증의 특징은 고성능 GPU나 외부 서버 없이 로봇 내장형 NPU에서 AI 모델을 직접 구동했다는 점이다.
비전언어행동모델은 영상 인식과 언어 이해, 행동 생성 기능을 통합한 AI 모델로, 일반적으로 높은 연산 성능을 요구한다. 노타는 모델 경량화와 NPU 연산 그래프 최적화, 멀티 NPU 런타임 구축 등을 통해 이를 엣지 환경에 구현했다고 설명했다.
회사는 카메라 영상 인식부터 언어 명령 해석, 행동 생성, 로봇 동작 실행까지 전 과정을 하나의 시스템에서 처리하도록 구성했다.
피지컬 AI 최적화 기술 확대
노타는 해당 기술을 적용한 로봇팔 시연을 ‘KRAIN 2026(Korea Real-World AI Network 2026)’ 행사에서 공개했다.
회사는 향후 모바일과 엣지 기기를 넘어 로봇·휴머노이드 분야까지 AI 최적화 기술 적용 범위를 확대할 계획이다.
한편 노타는 LG전자, 모빌린트와 함께 정부의 K-온디바이스 AI 반도체 기술개발 사업 휴머노이드 부문 국책과제에 참여하고 있으며, 국산 NPU 기반 로봇 AI 최적화 연구도 수행 중이다.













