나는엔지니어다
‘Notta’ 키워드 기사 1건
    image

    노타, 멀티모달 AI GPU 메모리 47% 절감

    AI 모델 경량화 기업 노타가 멀티모달 AI의 전문가 혼합(MoE) 구조에 특화한 프루닝 기술을 개발했다. 약 310억 파라미터 모델에서 전문가 모듈 25%를 제거해도 원본 성능 98%를 유지하면서 GPU 메모리 사용량을 58GB에서 31GB로 47% 절감했다. 추가 …

    2026.10.01 by 배종인 기자