Loading...

AI 뉴스

NVIDIA Triton이 클라우드 도입을 위한 AI 도구 선도

페이지 정보

작성자 xtalfi
작성일 2025.11.12 17:59
1,314 조회
0 추천
0 비추천

본문

compatible_engineer-working-with-cloud-infrastructure-and-server-racks-modern-data-management.jpg

(퍼플렉시티가 정리한 기사)


Cloud Native Computing Foundation과 SlashData는 11월 11일 Q4 2025 Technology Landscape Radar 보고서의 연구 결과를 발표하며, 클라우드 네이티브 생태계에서 주목받고 있는 주요 AI 도구들을 확인했습니다. 애틀랜타에서 열린 KubeCon + CloudNativeCon North America 2025에서 발표된 이 연구는 전 세계 300명 이상의 전문 개발자를 대상으로 AI 추론 도구, ML 오케스트레이션 시스템 및 에이전틱 AI 플랫폼을 평가했습니다.​

NVIDIA Triton, DeepSpeed, TensorFlow Serving, BentoML이 도입을 위해 평가된 최고의 AI 추론 도구로 선정되었으며, NVIDIA Triton은 성숙도와 유용성 모두에서 가장 높은 점수를 받았습니다. 이 보고서는 사용량, 성숙도, 유용성 및 추천도에 대한 종합 점수를 기반으로 기술을 도입(adopt), 시험(trial), 평가(assess), 보류(hold)의 네 가지 범주로 분류했습니다.​


추론 도구 및 ML 오케스트레이션 리드 채택

AI 추론의 경우, NVIDIA Triton은 인프라 집약적 AI 워크로드를 다루는 개발자들로부터 강한 신뢰를 받았으며, 50%가 성숙도에 대해 별 5개 등급을, 41%가 유용성에 대해 별 5개 등급을 부여했습니다. Adlik은 덜 널리 사용되지만, 현재 또는 이전 사용자들 사이에서 92%로 가장 높은 추천율을 기록했습니다.​

ML 오케스트레이션 카테고리에서는 Airflow와 Metaflow가 채택(adopt) 상태에 도달했습니다. Metaflow는 개발자의 84%가 별 4개 또는 5개로 평가하여 성숙도에서 선두를 차지했으며, Airflow는 유용성 평가에서 1위를 차지했고 특히 유용성에 대해 별 1개 또는 2개 평가를 받지 않았습니다. BentoML은 추론에 대해서는 채택(adopt) 등급을, 오케스트레이션에 대해서는 시험(trial) 등급을 받았으며, 이는 다중 역할 도구가 도메인 전반에 걸쳐 고르지 않게 성공할 수 있음을 보여줍니다.​


에이전틱 AI 플랫폼, 엇갈린 평가 보여

모델 컨텍스트 프로토콜(MCP)과 Llama Stack은 채택 카테고리에 도달한 유일한 에이전트 AI 도구였습니다. MCP는 80%로 4점과 5점 유용성 점수를 합한 점수가 가장 높았으며, 상위 도구 중 가장 광범위한 개발자 기반을 보유하고 있었습니다. Agent2Agent(A2A)는 더 새롭고 덜 성숙했지만 94%로 가장 높은 추천율을 받았습니다.​

CNCF의 CTO인 Chris Aniszczyk는 "AI 시스템을 구축하고 운영하는 조직들은 5년 전처럼 도구를 다룰 수 없습니다"라고 말했습니다. "이 새로운 연구가 확인하는 것은 확장 가능한 인프라와 오케스트레이션의 클라우드 네이티브 원칙이 백엔드 앱뿐만 아니라 추론 파이프라인과 에이전트 AI 시스템에도 기초가 된다는 것입니다."​

데이터는 현재 AI/ML 개발자의 41%가 클라우드 네이티브로 자신을 식별하며, 이 수치는 증가할 것으로 예상됩니다. 보고서는 개발자들이 스스로를 클라우드 네이티브라고 표시하지 않더라도, 그들의 AI/ML 시스템은 컨테이너화, 오케스트레이션, 확장성 및 신뢰성을 포함한 클라우드 네이티브 아키텍처에 의존한다는 것을 발견했습니다.

댓글 0
전체 1,366 / 46 페이지
Runway는 월요일에 Gen 4.5를 공개했으며, 이는 독립 벤치마킹 업체 Artificial Analysis가 관리하는 Video Arena 리더보드에서 1위를 차지한 새로운 AI 비디오 생성 모델로, 2위인 Google의 Veo 3 모델과 7위인 OpenAI의 Sora 2 Pro를 능가했다.PitchBook에 따르면 35억 5천만 달러의 가치를 평가받은 이 100명 규모의 스타트업은 블라인드 테스트를 사용하며, 투표자들이 어느 회사가 제작했는지 모르는 상태에서 비디오 결과물을 비교하여 순수한 사용자 선호도를 기반으로 편향되지 않은 순위를 보장한다.CEO Cristóbal Valenzuela는 CNBC에 Runway가 “100명의 팀으로 수조 달러 규모의 기업들을 능가하는 데 성공했다”고 말했으며, “David”라는 코드명의 이 모델은 주말까지 회사의 플랫폼, API 및 파트너 통합을 통해 모든 고객에게 제공될 예정이다.
660 조회
0 추천
2025.12.02 등록
Google은 12월 8일 오전 10시(태평양 표준시)에 30분간 라이브스트림을 개최하여 확장 현실 플랫폼인 Android XR의 업데이트를 공개할 예정이며, Gemini AI 통합이 적용된 헤드셋 및 스마트 안경의 새로운 기능에 중점을 둘 것입니다.이 행사는 10월에 출시된 Samsung의 Galaxy XR 헤드셋 출시에 이어 진행되는 것으로, 이는 1,799달러 가격의 첫 번째 Android XR 기기로서 4K 디스플레이와 손동작, 시선 추적, 음성 명령을 통한 AI 기반 상호작용을 특징으로 합니다.티저 자료에 따르면 Google은 2026년 출시 예정인 Samsung의 차기 스마트 안경을 선보일 가능성이 있으며, 이는 Apple의 부진한 Vision Pro 및 Meta의 보다 성공적인 Ray-Ban 스마트 안경과 경쟁하기 위한 것입니다.
656 조회
0 추천
2025.12.02 등록
• 한국 정부는 엔비디아로부터 약 1만3천 개의 GPU를 공급받아 국내 반입을 완료했으며, 이는 지난 5월 추경예산에서 확보한 1조4600억 원으로 집행됐다고 과학기술정보통신부가 1일 밝혔다.• 도입된 GPU에는 최신 B200 모델과 이전 세대 제품이 포함되어 있으며, 정부는 내년 초부터 대학·연구소·스타트업 등에 우선 배정하고 공공 분야에도 투입할 계획이다.• 이는 젠슨 황 CEO가 지난 10월 방한 시 약속한 총 26만여 장 규모(정부 5만 개, 삼성·SK·현대차 각 최대 5만 개, 네이버클라우드 6만 개)의 GPU 공급 계획 중 첫 물량이다.
681 조회
0 추천
2025.12.02 등록
Persistent Systems의 Dattaraj Rao는 VentureBeat에서 온톨로지(기업 맞춤형 개념, 계층 구조, 관계의 정의)가 AI 에이전트가 엔터프라이즈 데이터와 프로세스를 오해하지 않도록 필수적인 가드레일 역할을 한다고 주장합니다. 수십억 달러가 에이전트 인프라에 투자되었음에도 불구하고 실제 성공 사례는 제한적이라는 점을 지적합니다.기사에서는 엔터프라이즈 데이터의 단편화로 인해 중요한 모호성이 발생하는데, 예를 들어 “고객”이라는 단어가 Sales CRM에서는 한 종류의 사람을, 재무 시스템에서는 또 다른 종류의 사람을 의미할 수 있기 때문에, Neo4j와 같은 그래프 데이터베이스를 활용한 온톨로지 기반 접근 방식이 에이전트가 내장된 비즈니스 규칙을 따르면서 질의할 수 있는 통합된 진실의 원천을 마련해야 한다고 설명합니다.이러한 온톨로지 기반 아키텍처는 시급한 엔터프라이즈 과제를 해결합니다. AI의 환각(hallucination) 현상은 기업에게 큰 컴플라이언스와 의사결정 리스크를 야기할 수 있으며, 기술에 대한 관심이 빠르게 증가하고 있음에도 불구하고 실제로 에이전트 기반 AI 워크플로우를 성공적으로 확장한 기업은 11%에 불과하다고 밝혔습니다.
668 조회
0 추천
2025.12.01 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입