Loading...

AI 뉴스

마이크로소프트, 전력 부족으로 사용하지 못하는 AI 칩 보관중

페이지 정보

작성자 xtalfi
작성일 2025.11.04 15:00
1,914 조회
0 추천
0 비추천

본문

67d5401f4201fea22259360979170f81_1762236011_5946.jpg
 

(퍼플렉시티가 정리한 기사)


Microsoft CEO 사티아 나델라는 반도체 공급 문제가 아닌 전력 부족과 데이터 센터 인프라 제약이 현재 인공지능 확장을 제한하는 주요 장애물이라고 밝혔습니다. BG2 팟캐스트에서 나델라는 Microsoft가 현재 충분한 전력 인프라 부족으로 인해 배치할 수 없는 Nvidia 칩을 재고로 보유하고 있다고 공개했습니다.​

"우리가 현재 겪고 있는 가장 큰 문제는 컴퓨팅 과잉이 아니라 전력입니다"라고 나델라는 Altimeter Capital CEO 브래드 거스트너와의 인터뷰에서 말했습니다. "실제로 연결할 수 없는 많은 칩이 재고에 쌓여 있을 수 있습니다. 사실 그것이 오늘날 제 문제입니다. 칩의 공급 문제가 아니라 실제로 연결할 수 있는 준비된 설비가 없다는 것입니다".​


인프라 제약이 Azure 성장에 영향을 미침

전력 부족은 마이크로소프트의 클라우드 사업 실적에 직접적인 영향을 미쳤습니다. Azure 및 기타 클라우드 서비스는 2026 회계연도 1분기에 전년 대비 40% 성장했지만, Nadella는 적절한 컴퓨팅 용량이 확보되었다면 성장률이 더 높았을 것이라고 확인했습니다. 마이크로소프트는 이러한 인프라 제약에도 불구하고 전년 대비 26% 증가한 491억 달러의 클라우드 매출을 보고했습니다.​

최고재무책임자(CFO) Amy Hood는 실적 발표에서 용량 제약이 최소한 2026년 6월까지 지속될 것이며, 이는 2026 회계연도에 부족 현상이 완화될 것이라는 초기 전망을 넘어서는 것이라고 인정했습니다. "우리가 뒤처져 있다는 것을 알고 있습니다. 투자를 늘려야 합니다"라고 Hood는 말하며, 마이크로소프트가 이번 회계연도에 AI 용량을 80% 이상 증가시킬 계획이라고 언급했습니다.​


산업 전반의 전력 위기

이번 폭로는 AI 산업에 영향을 미치는 광범위한 인프라 위기를 반영합니다. Nadella가 언급한 "shells" — 전력 및 냉각수 인프라가 갖춰진 빈 데이터 센터 건물 —는 병목 현상이 반도체 제조에서 에너지 공급 및 냉각 솔루션으로 이동했음을 보여줍니다.​

Deloitte는 미국 내 AI 데이터 센터의 전력 수요가 2035년까지 30배 이상 증가하여 2024년 4기가와트에서 123기가와트에 달할 수 있다고 추정합니다. Lawrence Berkeley National Laboratory의 연구에 따르면 미국 데이터 센터는 국가 전력의 약 4%를 소비할 것으로 예상되며, 2028년까지 6.7-12%로 증가할 가능성이 있습니다.​

Microsoft는 향후 2년 동안 데이터 센터 규모를 거의 두 배로 늘리기로 약속했으며, 1분기에 349억 달러를 자본 지출로 투자했고, 그 중 약 절반은 Azure 수요를 지원하기 위한 GPU, CPU 및 인프라에 할당되었습니다. 회사의 상업용 잔여 이행 의무는 51% 급증하여 3,920억 달러에 달했으며, 이는 현재의 용량 제약에도 불구하고 강력한 미래 수요를 나타냅니다.

댓글 0
전체 1,366 / 32 페이지
• 중국은 금요일 슝안신구에서 오픈소스 AI 기상 모델인 Fengyuan V1.0을 출시했으며, 이는 관측 데이터로부터 직접 전 지구 예보를 생성할 수 있는 독자적 지식재산권을 가진 중국 최초의 종단간(end-to-end) AI 기상 시스템을 의미한다[chinadaily +1].• 이번 출시는 NOAA가 AI 기반 예보 모델 3종을 공개한 지 불과 이틀 만에 이루어진 것으로, 더 빠르고 정확한 AI 기상 예측 시스템 개발 경쟁에서 미국과 중국 간 기상 기술 분야의 경쟁이 심화되고 있음을 보여준다[techspot +2].• 중국 기상국 관계자들은 Fengyuan이 극한 기상 현상 탐지에 중점을 두고 저고도 경제 및 에너지 공급을 포함한 특화 분야를 지원할 것이며, 일대일로 이니셔티브를 통해 국제 협력을 확대할 계획이라고 밝혔다[chinadaily +1].
866 조회
0 추천
2025.12.21 등록
• 라쿠텐 그룹인 [RKUNY +1.40%]는 일본어에 최적화된 7,000억 파라미터 대규모 언어 모델 Rakuten AI 3.0를 12월 18일 공개했다. 이 모델은 일본어 벤치마크에서 GPT-4o를 능가했으며, 유사 규모의 서드파티 AI 모델 대비 최대 90%의 비용 절감을 제공한다.[global.rakuten +1]• 이 모델은 일본 정부가 지원하는 GENIAC 프로젝트의 일환으로 개발되었으며, 일본 경제산업성 및 신에너지·산업기술종합개발기구(NEDO)가 주도하고, 이 이니셔티브를 통해 일부 학습 비용을 지원받았다.[global.rakuten +1]• 라쿠텐은 2026년 봄에 이 모델을 오픈 웨이트로 공개할 계획이며, Rakuten AI Gateway 플랫폼을 통해 전자상거래, 핀테크, 여행, 엔터테인먼트 서비스 등 자사 전체 에코시스템에 이를 통합하고 있다.[global.rakuten +1]
853 조회
0 추천
2025.12.21 등록
• 한국 정부는 19일 제22차 국가핵융합위원회에서 핵융합에너지 전력생산 실증 목표를 2050년대에서 2030년대로 20년 앞당기는 로드맵을 의결했다[mk +2].• 정부는 2030년까지 노심 플라즈마 제어, 초전도 자석 등 8대 핵심기술을 개발하고 2035년까지 실증을 완료하며, 전남 나주에 1조5000억원 규모의 한국형 혁신 핵융합로를 건설할 계획이다[mk +2].• AI 데이터센터의 전력 소비가 2030년까지 2배 이상 증가할 것으로 예상되면서[g-enews], 트럼프 미디어가 핵융합 기업 TAE테크놀로지스와 합병하는 등 글로벌 핵융합 개발 경쟁이 가속화되고 있다[mk +2].
875 조회
0 추천
2025.12.21 등록
구글이 빠른 속도와 낮은 비용을 갖춘 경량 인공지능(AI) 모델 '제미나이3 플래시'를 17일(현지시간) 공개했다. 이번 출시로 구글은 최상위 모델인 '딥싱크', 균형 모델인 '프로'와 함께 제미나이3 제품군의 삼각 편대를 완성했다.상위 모델 능가하는 성능, 4분의 1 가격제미나이3 플래시는 일부 벤치마크에서 상위 모델인 제미나이3 프로를 능가하는 성과를 보였다. 일반 지식을 측정하는 'MMLU-Pro'에서 81.2%, 코딩 능력을 재는 'SWE-벤치 베리파이드'에서 78%를 기록해 프로 모델의 각각 81%와 76.2%를 웃돌았다.​과학 지식 평가인 'GPQA 다이아몬드'와 인류의 마지막 시험으로 불리는 'HLE' 벤치마크에서도 각각 90.4%와 33.7%를 기록해 프로 모델(91.9%, 37.5%)과 큰 차이가 없는 수준을 보였다.​속도와 지능의 균형제미나이3 플래시는 제미나이 2.5 프로보다 3배 빠른 속도를 자랑하며, 일상적 작업에서 평균 30% 적은 토큰을 사용한다. API 요금은 토큰당 0.5∼3달러로 프로 모델(2∼12달러)의 4분의 1 수준이다.​조시 우드워드 구글랩스·제미나이 담당 부사장은 "오랫동안 AI는 비싸고 느린 대형 모델과 성능이 떨어지는 고속 모델 사이 선택을 강요했다"며 "제미나이3 플래시는 이와 같은 타협을 끝내고 지능과 속도를 모두 제공한다"고 밝혔다.​제미나이3 플래시는 무료 이용자를 포함해 전 세계에서 사용할 수 있으며, 구글은 제미나이 앱과 AI 모드에서 이를 기본 모델로 적용했다.경량 모델은 방대한 데이터로 학습한 상위 모델을 기반으로 '증류'라는 작업을 거쳐 만들어진다. 속도가 빠르면서도 상위 모델에 버금가는 성능을 내는 것이 특징이다.
881 조회
0 추천
2025.12.20 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입