‘LLM’ 키워드 기사 37
    image

    “AI 성공, 양질의 데이터 확보·GPU 등 인프라 병렬화·최적화가 핵심”

    12월10일 소공동 롯데호텔에서 개최된 인공지능반도체 미래기술 컨퍼런스에서 전기정 LG AI연구원 부문장은 ‘AX성공의 열쇠:EXAONE AI Stock 전략 사례’를 주제로 발표하며, “AI의 성공적 도입을 위해서는 데이터 생성·가공의 자동화, 인프라의 효율적 확장,…

    2025.12.10 by 배종인 기자

    image

    AMD, 자이프라의 프런티어급 AI 모델 학습 지원

    글로벌 반도체 기업 AMD가 혁신적인 AI 스타트업 자이프라(Zyphra)와 협력해 최초의 대규모 전문가 혼합(Mixture-of-Experts, MoE) 파운데이션 모델 ZAYA1을 성공적으로 훈련했다. 이번 성과는 AMD 인스팅트(Instinct) MI300X GP…

    2025.11.25 by 배종인 기자

    image

    [2025 e4ds Tech Day]“온디바이스 AI 시대, 경량화 기술이 핵심”

    “경량화는 단순히 모델을 작게 만드는 것이 아니다. 저전력 디바이스에서 실시간으로 AI를 구동하기 위해서는 연산량을 줄이고, 하드웨어에 맞게 최적화하는 복합적인 기술이 필요하다. 특히 온디바이스 AI 환경에서는 클라우드에 의존하지 않고 디바이스 자체에서 AI를 실행해야…

    2025.10.20 by 명세환 기자

    image

    델, 책상 위에서 2,000억 매개변수 LLM 구현

    델 테크놀로지스(Dell)가 초고성능 데스크톱 AI 시스템 ‘델 프로 맥스 위드 GB10(Dell Pro Max with GB10)’을 공식 발표했다. 이 제품은 엔비디아의 최신 그레이스 블랙웰(GRACE BLACKWELL) 아키텍처 기반 GB10 슈퍼칩을 탑재해, 클…

    2025.10.14 by 배종인 기자

    image

    데이터브릭스, 오픈AI와 파트너십 체결…GPT-5 기반 프론티어 인텔리전스 제공

    글로벌 데이터 및 AI 기업 데이터브릭스(Databricks)가 오픈AI와 1억 달러 규모의 전략적 파트너십을 체결하고, 자사 데이터 인텔리전스 플랫폼과 대표 AI 제품인 에이전트 브릭스(Agent Bricks)에 오픈AI의 최신 모델을 네이티브로 통합했다.

    2025.09.26 by 배종인 기자

    image

    “낮은 사양에서도 고성능 LLM 구현”

    AI 최적화 및 경량화 기술 전문기업 노타(대표 채명수)는 25일 낮은 사양의 디바이스에서도 대규모 언어모델(LLM)을 안정적으로 구현할 수 있는 ‘LLM 최적화 서비스’를 공식 출시했다. 이 서비스는 기존 하드웨어를 그대로 활용하면서도 최신 LLM과 비전-언어모델(V…

    2025.09.25 by 배종인 기자

    image

    “AI 적용 위한 PoC는 끝났다, 온프레미스 전환해야”

    델 테크놀로지스(Dell Technologies) 조용노 전무가 17일 Dell AI Factory Media Briefing에서 이제 AI는 단순한 기술 시연을 넘어, AI가 실제 업무에 적용하는 단계에 진입했다며 엔터프라이즈 AI에 집중하며, 퍼블릭 클라우드의 한계…

    2025.09.17 by 배종인 기자

    image

    “현재는 AI와 인간의 경주 시대, AI 극복하고 활용해야”

    김경진 델 테크놀로지스 코리아 총괄사장이 17일 ‘델 테크놀로지스 포럼(Dell Technologies Forum’ 인사말을 통해 “현재는 AI와 인간의 경주 시대다. AI는 단순한 도구가 아닌, 마치 생명체와 같은 존재로 인간은 AI에 종속되지 않고 이를 활용하는 방…

    2025.09.17 by 배종인 기자

    image

    SKT, 자체 LLM 기술로 초거대 AI 모델 도전…A.X 3.1·4.0 4종 전격 오픈소스 공개

    SK텔레콤(대표이사 유영상)이 글로벌 오픈소스 커뮤니티 허깅페이스(Hugging Face)에 자체 개발한 대형 언어 모델(LLM) ‘A.X(에이닷 엑스) 3.1’을 공개하며 국내 AI 주도권 확보에 나섰다. SKT는 반도체·모델·데이터·서비스를 잇는 ‘풀스택 AI’ 역…

    2025.07.24 by 배종인 기자

    image

    잠재 추론 트랜스포머 모델 출현, HBM 지고 PIM 도래

    딥시크의 출현으로 기존 판도에 균열이 발생하고 있다. AI 하드웨어 시장에 HBM 의존도를 낮출 수 있는 새로운 트랜스포머 모델들의 출현이 가속화되면서 빠른 미래 혁신의 흐름에 대응할 필요성이 있어 보인다. 최근 7일 메릴랜드 대학 연구진은 ‘Scaling up Tes…

    2025.02.17 by 권신혁 기자

    image

    ​솔트웨어, LLM 기반 AI 에이전트 도입

    AI 전문 기업 솔트웨어가 기존 AWS 기술지원 시스템에 자체 개발한 생성형 AI 기반 어시스턴트 AI를 추가해 현업에 적용했다고 13일 밝혔다.

    2025.02.13 by 명세환 기자

    image

    AI 성능, 스토리지 네트워크 영향 高

    스토리지 성능은 AI 수명주기의 여러 단계에서 핵심적인 역할을 한다. GPU를 연결하는 네트워크가 AI 애플리케이션 성능에 매우 중요한 것처럼, 고속 스토리지 어레이를 연결하는 스토리지 패브릭 중요성이 점차 커지고 있다.

    2025.02.06 by 권신혁 기자

    image

    딥시크 충격, 온디바이스 AI 부흥 단초...사전학습모델 구축 비용은 高

    중국 AI 스타트업 딥시크(DeepSeek)에서 만든 추론모델 딥시크 R1의 등장으로 AI 업계 파문이 일고 있다. 경량화된 파라미터를 기반으로 저렴한 비용 대비 뛰어난 성능으로 AI 발전방향의 패러다임을 제시했다는 점에서 대표격으로 주목 받고 있다. 딥시크 R1…

    2025.02.03 by 권신혁 기자

    image

    ​엔비디아, AI 가드레일 위한 NIM 마이크로서비스 출시

    AI 에이전트는 다양한 작업 수행에 필요한 AI 디바이스를 통해 전세계 수십억 지식 근로자의 생산성을 변화시킬 잠재력을 갖췄다. 그러나 기업들이 AI 에이전트를 개발하기 위해서는 △신뢰 △안전 △보안 △규정 준수 등과 같은 중요한 문제를 해결해야 한다.

    2025.01.17 by 명세환 기자

    image

    ​클라우드 기반 웹 AI 에이전트 ‘러너 H’ 출시

    AI 에이전트 선도 기업 ‘H’가 클라우드 기반 웹 에이전트인 러너 H(Runner H)를 출시한다고 21일 발표했다. H는 러너 H 0.1 베타 버전 출시를 통해 초인공지능(artificial super intelligence, ASI)으로 도약을 지원하며, …

    2024.11.21 by 명세환 기자