Loading...

AI 뉴스

AMD, 엔비디아의 AI 지배력에 도전하기 위해 오픈소스 ROCm 추진

페이지 정보

작성자 xtalfi
작성일 2025.11.28 14:57
469 조회
0 추천
0 비추천

본문

data-center-3.jpg

AMD는 오픈소스 ROCm 플랫폼을 Nvidia의 독점적 CUDA 생태계에 대한 협력적 대안으로 포지셔닝함으로써 AI 컴퓨팅 분야에서 Nvidia의 지배력에 대한 도전을 강화하고 있으며, 특히 아시아-태평양 지역의 개발자와 데이터 센터를 대상으로 벤더 종속 없이 유연성을 추구하는 고객들을 타겟으로 하고 있습니다.

이 칩 제조업체는 2025년 9월 ROCm 7을 출시하면서 Instinct MI350 및 MI325X GPU에 대한 기본 지원, 더 빠른 AI 추론을 위한 FP4 및 FP8를 포함한 저정밀도 형식, 그리고 확장된 Windows 및 소비자용 GPU 호환성을 제공했습니다. 이 플랫폼은 PyTorch 및 vLLM과 같은 인기 있는 프레임워크와 처음부터 통합되어 개발자들이 소프트웨어 스택을 재구축하지 않고도 AMD 하드웨어에서 AI 워크로드를 배포할 수 있게 합니다.​

AMD의 AI 소프트웨어 부사장인 Anush Elangovan은 이번 주 Computer Weekly와의 인터뷰에서 "우리는 폐쇄형 소스를 구축할 수도 있지만, 오픈 생태계의 속도를 얻을 수 없을 것입니다"라고 말했습니다. "대신, 우리는 업계를 발전시키기 위해 모든 사람의 역량을 활용하고자 합니다. 이는 모두가 협력하고 매우 빠르게 움직이는 Linux 커널과 같습니다."​


ROCm, Nvidia가 새로운 경쟁자들과 맞서면서 입지를 다지다

AMD의 시점은 여러 방면에서 Nvidia에 대한 압력이 커지는 것과 맞물려 있습니다. 지난주에 Meta Platforms가 Google의 텐서 프로세싱 유닛(TPU)을 사용하기 위해 수십억 달러 규모의 거래를 협상 중이라는 보도가 나오면서 Nvidia 주가는 하락하고 Alphabet 주가는 상승하는 등, AI 칩 시장의 경쟁에 대한 투자자들의 우려가 나타났습니다. Nvidia는 11월 25일 자사의 GPU가 Google의 AI 칩보다 “한 세대 앞서 있다”고 주장하며 대응했습니다.​

이와 같은 경쟁 구도는 주요 IT 기업들이 하드웨어 다각화로 나아가도록 만들고 있습니다. Red Hat은 11월 23일 Red Hat Enterprise Linux에서 AMD, Intel, Nvidia의 AI 가속기 드라이버를 간편하게 접근할 수 있도록 streamlined 경험을 발표하며, 다중 공급업체 지원에 대한 기업의 수요를 반영하고 있습니다. 올해 초 Red Hat은 AMD GPU Operator를 OpenShift AI 플랫폼에 통합했으며, Intel 및 Nvidia와의 유사한 협력 관계에도 합류했습니다.​


소프트웨어 생태계가 데이터 센터를 넘어 확장되다

AMD의 "ROCm everywhere" 이니셔티브는 소비자용 노트북부터 슈퍼컴퓨터까지 일관된 개발자 경험을 제공하는 것을 목표로 합니다. Elangovan은 회사의 칩렛 아키텍처가 경쟁력 있는 성능을 유지하면서도 값비싼 액체 냉각 대신 공랭식 인프라를 가능하게 한다고 언급했습니다.​

최근 검증 사례로 Luma Labs가 있으며, Elangovan에 따르면 이들의 Ray3 비디오 생성 모델은 "AMD 플랫폼에서 완전히 훈련되고 서비스되고 있습니다". 11월 18일, Luma는 AMD가 주요 참여자로 참여한 9억 달러 규모의 시리즈 C 펀딩 라운드를 발표하며 파트너십을 심화했습니다.​

Zyphra 또한 11월 14일 자사의 ZAYA1 AI 모델 테스트를 완료했으며, 이는 AMD Instinct MI300X GPU와 ROCm에서 전적으로 훈련된 최초의 대규모 Mixture-of-Experts 파운데이션 모델로, 주요 AI 연구소의 모델들과 경쟁력 있는 성능을 입증했습니다.

댓글 0
전체 1,366 / 42 페이지
• 한국 정부는 엔비디아로부터 약 1만3천 개의 GPU를 공급받아 국내 반입을 완료했으며, 이는 지난 5월 추경예산에서 확보한 1조4600억 원으로 집행됐다고 과학기술정보통신부가 1일 밝혔다.• 도입된 GPU에는 최신 B200 모델과 이전 세대 제품이 포함되어 있으며, 정부는 내년 초부터 대학·연구소·스타트업 등에 우선 배정하고 공공 분야에도 투입할 계획이다.• 이는 젠슨 황 CEO가 지난 10월 방한 시 약속한 총 26만여 장 규모(정부 5만 개, 삼성·SK·현대차 각 최대 5만 개, 네이버클라우드 6만 개)의 GPU 공급 계획 중 첫 물량이다.
463 조회
0 추천
2025.12.02 등록
Persistent Systems의 Dattaraj Rao는 VentureBeat에서 온톨로지(기업 맞춤형 개념, 계층 구조, 관계의 정의)가 AI 에이전트가 엔터프라이즈 데이터와 프로세스를 오해하지 않도록 필수적인 가드레일 역할을 한다고 주장합니다. 수십억 달러가 에이전트 인프라에 투자되었음에도 불구하고 실제 성공 사례는 제한적이라는 점을 지적합니다.기사에서는 엔터프라이즈 데이터의 단편화로 인해 중요한 모호성이 발생하는데, 예를 들어 “고객”이라는 단어가 Sales CRM에서는 한 종류의 사람을, 재무 시스템에서는 또 다른 종류의 사람을 의미할 수 있기 때문에, Neo4j와 같은 그래프 데이터베이스를 활용한 온톨로지 기반 접근 방식이 에이전트가 내장된 비즈니스 규칙을 따르면서 질의할 수 있는 통합된 진실의 원천을 마련해야 한다고 설명합니다.이러한 온톨로지 기반 아키텍처는 시급한 엔터프라이즈 과제를 해결합니다. AI의 환각(hallucination) 현상은 기업에게 큰 컴플라이언스와 의사결정 리스크를 야기할 수 있으며, 기술에 대한 관심이 빠르게 증가하고 있음에도 불구하고 실제로 에이전트 기반 AI 워크플로우를 성공적으로 확장한 기업은 11%에 불과하다고 밝혔습니다.
449 조회
0 추천
2025.12.01 등록
• ChatGPT는 11월 30일 3주년을 맞아 주간 활성 사용자 8억 명을 기록하며, 2022년 출시 이후 역사상 가장 빠르게 성장한 소비자 애플리케이션 중 하나가 되었습니다.[kmph +1]• Google의 Gemini 3 Pro는 11월 18일 출시되어 현재 벤치마크 리더보드 1위를 차지하고 있으며, 경쟁이 심화됨에 따라 OpenAI CEO Sam Altman이 직원들에게 “어려운 시기”와 “일시적인 경제적 장애물”에 대해 경고하게 만들었습니다.[axios +1]• Deakin University 연구에 따르면 ChatGPT는 학술 인용의 약 5분의 1을 조작했으며, 전체 인용의 56%가 가짜이거나 오류를 포함하고 있어 지속적인 정확성 문제를 부각시켰습니다.[studyfinds]
424 조회
0 추천
2025.12.01 등록
네이버클라우드가 전문 지식 없이도 사내 데이터 기반으로 맞춤형 AI 어시스턴트를 제작할 수 있는 ‘네이버웍스 AI 스튜디오’를 1일 출시했다고 밝혔다.이 도구는 메시지 검색, 보고서 작성 등 업무용 어시스턴트뿐 아니라 점심 메뉴 추천, MBTI 분석 등 창의적인 어시스턴트 제작도 가능하며, 메일 답장 제안과 드라이브 파일 번역 등 AI 기능도 대폭 강화됐다.네이버웍스는 일본에서 8년 연속 유료 비즈니스 챗 시장 1위를 차지했으며, 회의록 정리 시간을 2시간에서 30분으로 단축하는 등 업무 효율 70% 이상 개선 효과를 입증했다고 밝혔다.
440 조회
0 추천
2025.12.01 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입