‘프루닝’ 키워드 기사 3건
노타, 문샷AI ‘키미 K3’ 경량화…엔비디아 B300 GPU 8장→4장
AI 모델 최적화 기업 노타가 문샷AI의 2조8,000억 매개변수 초거대 AI 모델 ‘키미 K3’를 경량화했다. 자체 개발한 비균일 전문가 프루닝 기술을 적용해 필요 GPU를 8장에서 4장으로 절감하면서도 핵심 성능을 유지했다. 이 기술은 층별 특성을 분석해 기여도 낮…
2026.08.06 by 배종인 기자
노타, AI 인프라 비용 최대 76.5% 절감…‘솔라 오픈2’ 전용 경량화 모델 공개
AI 모델 경량화 전문기업 노타가 업스테이지의 정부 독자 AI 파운데이션 모델 솔라 오픈2의 경량화 버전을 공개했다. MoE 양자화와 프루닝 기술을 적용해 가중치 메모리를 76.5% 감축했으며, 필요한 GPU를 8장에서 2장으로 줄였다. 기업의 AI 인프라 비용 절감 …
2026.07.27 by 배종인 기자

“엣지 AI 모델은 돌아가는데 제품은 안 된다? 하드웨어 특성 고려가 우선”
노타 AI 조석영 매니저는 지난 3월6일 코엑스에서 개최된 ‘e4ds Physical AI Frontier 2026’에서 ‘엣지 AI에서의 AI 추론, 경량화 모델 및 경량화 방법’에 대해 발표하며, 현장 개발자의 병목을 정면으로 겨냥한 경량화·최적화 전략을 공개했다.…
2026.03.24 by 배종인 기자

