Loading...

AI 뉴스

AI 기업, AMD 칩으로만 최초의 대규모 모델 훈련 완료

페이지 정보

작성자 xtalfi
작성일 2025.11.25 16:00
612 조회
0 추천
0 비추천

본문

data-center-1.jpg

샌프란시스코에 기반을 둔 AI 연구 기업 자이프라(Zyphra)는 일요일, 자사가 최초로 대규모 Mixture-of-Experts(전문가 혼합) 기반 파운데이션 모델인 ZAYA1을 완전히 AMD 하드웨어에서 학습시키는 데 성공했다고 발표했습니다. 이는 AI 모델 학습 분야에서 NVIDIA의 지배에 도전하는 중요한 이정표로 평가받고 있습니다.

이 모델은 AMD Instinct MI300X GPU 및 AMD Pensando 네트워킹, IBM 클라우드 인프라에서 학습을 진행했으며, NVIDIA의 플랫폼 외에도 최첨단 AI 개발을 충분히 감당할 수 있다는 점을 입증했습니다. 총 83억 개의 파라미터에 활성 파라미터는 7억 6천만 개만 사용했음에도 불구하고, ZAYA1은 Meta의 Llama-3-8B, Alibaba의 Qwen3-4B, Google의 Gemma3-12B 등 더 큰 모델들과 견주거나 더 나은 성능을 추론, 수학, 코딩 벤치마크에서 보였습니다.​


기술적 돌파구가 AMD의 AI 역량을 입증하다

이 성과는 AMD 플랫폼의 여러 기술적 장점을 보여줍니다. MI300X GPU의 192GB 고대역폭 메모리는 비용이 많이 드는 전문가 샤딩이나 텐서 샤딩 없이 효율적인 대규모 학습을 가능하게 하여 개발 프로세스를 간소화했습니다. Zyphra는 AMD 최적화 분산 I/O를 사용하여 10배 이상 빠른 모델 저장 시간을 달성했으며, 이를 통해 학습 신뢰성과 효율성을 향상시켰다고 보고했습니다.​

Zyphra의 CEO인 Krithik Puthalath는 "ZAYA1은 이러한 철학을 반영하며, AMD 플랫폼에서 대규모 학습을 시연한 최초의 회사가 되어 기쁘게 생각합니다"라고 말했습니다. 이번 협력은 10월에 발표된 IBM과 AMD 간의 다년간 계약을 기반으로 하며, Zyphra에 고급 AI 인프라를 제공하기 위한 것입니다.​


AI 하드웨어 시장에 대한 경쟁적 시사점

성공적인 훈련은 현재 NVIDIA가 지배하고 있는 AI 인프라 시장에서 더 많은 점유율을 확보하려는 AMD의 중요한 과제를 해결합니다. AMD는 AI 훈련 GPU 시장에서 NVIDIA에 비해 약 94%의 시장 점유율 열세를 보이고 있지만, 향후 3~5년 동안 데이터 센터 AI 사업이 연평균 60% 이상의 성장률을 기록할 것으로 전망하고 있습니다.​​

Mixture-of-Experts 아키텍처는 OpenAI의 GPT-5, Anthropic의 Claude-4.5, DeepSeek-V3를 포함한 현대 최첨단 AI 시스템의 기본 설계가 되었습니다. 이러한 모델은 동적으로 활성화되는 전문화된 전문가 네트워크를 사용하여 기존의 밀집 아키텍처보다 더 큰 효율성과 확장성을 제공합니다.​

AMD의 수석 부사장 겸 최고 상업 책임자인 Philip Guido는 "이 이정표는 혁신적인 AMD 하드웨어 및 소프트웨어 솔루션이 업계 선두 기업들과 함께 차세대 최첨단 AI 개발을 가능하게 하고 있음을 강조합니다"라고 말했습니다.

댓글 0
전체 1,366 / 34 페이지
대한민국 과학기술정보통신부와 KAIST는 12월 11일, 300명의 학생(학부 100명, 석사 150명, 박사 50명)을 모집하는 독립 AI 대학을 설립하겠다는 계획을 발표했으며, 학부 과정은 2026년 봄부터, 대학원(석·박사) 모집은 2026년 가을부터 시작될 예정이다.이 계획은 심각한 인재 부족에 대응하기 위한 것으로, 대한민국은 2025년 세계 디지털 경쟁력 순위에서 9계단 하락한 15위를 기록했고, 인재 경쟁력은 69개국 중 49위에 그쳤으며, 향후 5년간 AI 및 신기술 분야에서 최소 58만 명의 인력이 부족할 것으로 전망되고 있다.정부는 2027년까지 광주과학기술원, 대구경북과학기술원, 울산과학기술원으로 AI 대학을 확대할 계획이며, 각 기관은 에너지, 조선, 로봇 등 지역 산업에 특화된 교육과 연구에 집중할 예정이다.
448 조회
0 추천
2025.12.12 등록
마이크로소프트 CEO 사티아 나델라는 목요일, 자신이 추수감사절 연휴 동안 크리켓을 분석하는 맞춤형 인공지능 애플리케이션을 코딩했다고 밝혔으며, 인도에 175억 달러를 투자한다는 회사의 발표와 함께 벵갈루루에서 열린 개발자 행사에서 이 도구를 시연했다.​나델라가 "생각의 사슬(chain of thought)"이 아닌 "논쟁의 사슬(chain of debate)"이라고 부르는 방식을 사용하여 구축한 이 애플리케이션은 여러 대규모 언어 모델을 협의체로 활용하여 결정을 논의하고 합의에 도달하도록 한다. 그는 이 도구를 사용하여 역대 인도 테스트 크리켓 XI를 선정했으며, 서로 다른 AI 모델들이 어떻게 협력하여 복잡한 결정을 종합할 수 있는지 보여주었다.​다중 모델 AI 위원회가 크리켓 선발을 결정하다Deep Research AI 앱은 전 OpenAI 연구원 Andrej Karpathy의 LLM Council 개념에서 영감을 받은 프레임워크를 활용하는데, GPT, Gemini, Claude, DeepSeek, Grok을 포함한 여러 모델이 "평의회 구성원" 역할을 하고 의장 모델이 그들의 집단적 추론을 종합합니다. "시스템은 합의 영역, 토론, 추론 체인 등 모든 것을 생성했습니다. 환상적이었습니다"라고 Nadella는 Bengaluru 행사에서 말했습니다. "저는 Copilot 팀에서 일하고 싶었습니다".​AI 시스템은 Sunil Gavaskar, Virender Sehwag, Rahul Dravid, Sachin Tendulkar, Virat Kohli, Kapil Dev, Ravichandran Ashwin, Jasprit Bumrah를 포함한 합의된 선택을 식별했으며, VVS Laxman의 클러치 퍼포먼스와 Anil Kumble 또는 Zaheer Khan 중 누구를 선택할 것인지에 대한 논쟁적인 토론을 진행했습니다. 가장 치열한 심의는 Kohli와 Mahendra Singh Dhoni 사이의 주장 선택에 집중되었으며, 최종적으로 Kohli가 선택되었습니다.​크리켓 투자가 AI 혁신을 만나다시애틀 오르카스 프로 T20 크리켓 팀을 공동 소유하고 있으며 영국 런던 스피릿의 49% 지분을 1억 8,200만 달러에 인수한 컨소시엄의 일원이었던 나델라는 이 앱이 Microsoft Copilot에 통합될 것이라고 말했다. 그는 X에 이 앱을 "여러 모델과 의사결정 프레임워크를 활용한 심층 연구를 위해" 만들었으며 "이것을 '논쟁의 연쇄'로 생각하라...다음 목적지는 Copilot!!"이라고 게시했다.​이 시연은 나델라의 인도 방문 중에 이루어졌으며, Microsoft는 아시아에서 최대 규모의 투자인 175억 달러를 향후 4년간 AI 및 클라우드 인프라 확장, 기술 교육 이니셔티브, 그리고 전국적인 운영에 투자하겠다고 약속했다. 회사는 2026년 중반까지 하이데라바드에 새로운 데이터 센터 지역을 개설할 계획이며, Cognizant, Infosys, TCS, Wipro와의 파트너십을 통해 총 20만 개 이상의 Copilot 라이선스를 배포할 것이라고 발표했다.​
431 조회
0 추천
2025.12.12 등록
Google는 The Guardian, The Washington Post, Der Spiegel을 포함한 주요 출판사들과 상업 파일럿 프로그램을 시작하여 Google News 페이지에서 AI 기반 기사 개요 및 오디오 브리핑을 테스트하고 있으며, 참여 매체들은 잠재적인 트래픽 손실을 상쇄하기 위한 직접 지급금을 받게 됩니다.이번 발표는 유럽 위원회가 Google이 적절한 보상 없이 AI 기능을 위해 출판사 콘텐츠를 사용하는지 여부에 대한 공식 독점금지 조사를 개시한 이후 나온 것으로, AI 요약이 출판사 추천 트래픽을 최대 34.5%까지 감소시킬 수 있다는 연구 결과가 나온 가운데 이루어졌습니다.Google은 영어 사용자를 위해 Preferred Sources 기능을 전 세계적으로 확대하고 유료 뉴스 콘텐츠를 우선순위에 두는 구독 강조 기능을 도입하고 있으며, 선호 소스를 지정한 사용자는 평균적으로 해당 사이트를 두 배 더 자주 클릭하는 것으로 나타났습니다.
425 조회
0 추천
2025.12.11 등록
Adobe는 수요일에 Photoshop, Adobe Express, Acrobat을 ChatGPT에 통합하여 사용자들이 챗봇 인터페이스를 벗어나지 않고도 대화형 명령어를 통해 무료로 이미지를 편집하고, 디자인을 생성하며, PDF를 수정할 수 있도록 했다.이번 통합은 매주 8억 명이 넘는 ChatGPT 사용자들에게 Adobe의 창작 도구에 대한 접근을 제공하지만, 데스크톱 버전에 비해 제한된 기능을 제공하며, 이는 챗봇을 제3자 디지털 서비스의 관문으로 전환하려는 OpenAI의 전략의 일환이다.이 파트너십은 5월에 네이티브 이미지 편집 기능을 출시한 Google의 Gemini AI에 맞서 두 회사를 위치시키는 동시에, Adobe에게는 ChatGPT의 방대한 사용자 기반에 대한 노출을 제공하고 회사가 “에이전틱 대화형 인터페이스”라고 부르는 것을 가능하게 한다.
429 조회
0 추천
2025.12.11 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입