‘GPU 효율화’ 키워드 기사 1건
    image

    노타, EMNLP 2026서 MoE 양자화 논문 2편 채택

    AI 모델 경량화 기업 노타가 EMNLP 2026에서 초거대언어모델 최적화 논문 2편 채택을 확보했다. MoE 양자화 기술로 Qwen 3.8 Max 구동 시 필요한 GPU를 24장에서 4장으로 대폭 축소할 수 있음을 입증했다. 데이터센터 AI 인프라 운영 효율을 높이는…

    2026.08.25 by 배종인 기자