Loading...

AI 뉴스

NVIDIA Triton이 클라우드 도입을 위한 AI 도구 선도

페이지 정보

작성자 xtalfi
작성일 2025.11.12 17:59
1,404 조회
0 추천
0 비추천

본문

compatible_engineer-working-with-cloud-infrastructure-and-server-racks-modern-data-management.jpg

(퍼플렉시티가 정리한 기사)


Cloud Native Computing Foundation과 SlashData는 11월 11일 Q4 2025 Technology Landscape Radar 보고서의 연구 결과를 발표하며, 클라우드 네이티브 생태계에서 주목받고 있는 주요 AI 도구들을 확인했습니다. 애틀랜타에서 열린 KubeCon + CloudNativeCon North America 2025에서 발표된 이 연구는 전 세계 300명 이상의 전문 개발자를 대상으로 AI 추론 도구, ML 오케스트레이션 시스템 및 에이전틱 AI 플랫폼을 평가했습니다.​

NVIDIA Triton, DeepSpeed, TensorFlow Serving, BentoML이 도입을 위해 평가된 최고의 AI 추론 도구로 선정되었으며, NVIDIA Triton은 성숙도와 유용성 모두에서 가장 높은 점수를 받았습니다. 이 보고서는 사용량, 성숙도, 유용성 및 추천도에 대한 종합 점수를 기반으로 기술을 도입(adopt), 시험(trial), 평가(assess), 보류(hold)의 네 가지 범주로 분류했습니다.​


추론 도구 및 ML 오케스트레이션 리드 채택

AI 추론의 경우, NVIDIA Triton은 인프라 집약적 AI 워크로드를 다루는 개발자들로부터 강한 신뢰를 받았으며, 50%가 성숙도에 대해 별 5개 등급을, 41%가 유용성에 대해 별 5개 등급을 부여했습니다. Adlik은 덜 널리 사용되지만, 현재 또는 이전 사용자들 사이에서 92%로 가장 높은 추천율을 기록했습니다.​

ML 오케스트레이션 카테고리에서는 Airflow와 Metaflow가 채택(adopt) 상태에 도달했습니다. Metaflow는 개발자의 84%가 별 4개 또는 5개로 평가하여 성숙도에서 선두를 차지했으며, Airflow는 유용성 평가에서 1위를 차지했고 특히 유용성에 대해 별 1개 또는 2개 평가를 받지 않았습니다. BentoML은 추론에 대해서는 채택(adopt) 등급을, 오케스트레이션에 대해서는 시험(trial) 등급을 받았으며, 이는 다중 역할 도구가 도메인 전반에 걸쳐 고르지 않게 성공할 수 있음을 보여줍니다.​


에이전틱 AI 플랫폼, 엇갈린 평가 보여

모델 컨텍스트 프로토콜(MCP)과 Llama Stack은 채택 카테고리에 도달한 유일한 에이전트 AI 도구였습니다. MCP는 80%로 4점과 5점 유용성 점수를 합한 점수가 가장 높았으며, 상위 도구 중 가장 광범위한 개발자 기반을 보유하고 있었습니다. Agent2Agent(A2A)는 더 새롭고 덜 성숙했지만 94%로 가장 높은 추천율을 받았습니다.​

CNCF의 CTO인 Chris Aniszczyk는 "AI 시스템을 구축하고 운영하는 조직들은 5년 전처럼 도구를 다룰 수 없습니다"라고 말했습니다. "이 새로운 연구가 확인하는 것은 확장 가능한 인프라와 오케스트레이션의 클라우드 네이티브 원칙이 백엔드 앱뿐만 아니라 추론 파이프라인과 에이전트 AI 시스템에도 기초가 된다는 것입니다."​

데이터는 현재 AI/ML 개발자의 41%가 클라우드 네이티브로 자신을 식별하며, 이 수치는 증가할 것으로 예상됩니다. 보고서는 개발자들이 스스로를 클라우드 네이티브라고 표시하지 않더라도, 그들의 AI/ML 시스템은 컨테이너화, 오케스트레이션, 확장성 및 신뢰성을 포함한 클라우드 네이티브 아키텍처에 의존한다는 것을 발견했습니다.

댓글 0
전체 1,366 / 38 페이지
Google는 The Guardian, The Washington Post, Der Spiegel을 포함한 주요 출판사들과 상업 파일럿 프로그램을 시작하여 Google News 페이지에서 AI 기반 기사 개요 및 오디오 브리핑을 테스트하고 있으며, 참여 매체들은 잠재적인 트래픽 손실을 상쇄하기 위한 직접 지급금을 받게 됩니다.이번 발표는 유럽 위원회가 Google이 적절한 보상 없이 AI 기능을 위해 출판사 콘텐츠를 사용하는지 여부에 대한 공식 독점금지 조사를 개시한 이후 나온 것으로, AI 요약이 출판사 추천 트래픽을 최대 34.5%까지 감소시킬 수 있다는 연구 결과가 나온 가운데 이루어졌습니다.Google은 영어 사용자를 위해 Preferred Sources 기능을 전 세계적으로 확대하고 유료 뉴스 콘텐츠를 우선순위에 두는 구독 강조 기능을 도입하고 있으며, 선호 소스를 지정한 사용자는 평균적으로 해당 사이트를 두 배 더 자주 클릭하는 것으로 나타났습니다.
603 조회
0 추천
2025.12.11 등록
Adobe는 수요일에 Photoshop, Adobe Express, Acrobat을 ChatGPT에 통합하여 사용자들이 챗봇 인터페이스를 벗어나지 않고도 대화형 명령어를 통해 무료로 이미지를 편집하고, 디자인을 생성하며, PDF를 수정할 수 있도록 했다.이번 통합은 매주 8억 명이 넘는 ChatGPT 사용자들에게 Adobe의 창작 도구에 대한 접근을 제공하지만, 데스크톱 버전에 비해 제한된 기능을 제공하며, 이는 챗봇을 제3자 디지털 서비스의 관문으로 전환하려는 OpenAI의 전략의 일환이다.이 파트너십은 5월에 네이티브 이미지 편집 기능을 출시한 Google의 Gemini AI에 맞서 두 회사를 위치시키는 동시에, Adobe에게는 ChatGPT의 방대한 사용자 기반에 대한 노출을 제공하고 회사가 “에이전틱 대화형 인터페이스”라고 부르는 것을 가능하게 한다.
627 조회
0 추천
2025.12.11 등록
에너지부는 인공지능 기반 연구 자동화를 통해 10년 내에 미국의 과학 생산성을 두 배로 늘리는 것을 목표로 하는 트럼프 대통령의 AI 이니셔티브인 제네시스 미션에 3억 2천만 달러 이상의 투자를 발표했습니다.DOE 차관 다리오 길은 의원들에게 이 자금이 미국 과학 클라우드(American Science Cloud)와 혁신적 모델 컨소시엄(Transformational Model Consortia)을 지원할 것이며, 전담 팀들이 이미 슈퍼컴퓨터 시간을 자동으로 할당하고, 결과를 분석하며, 실험을 시작하는 AI 워크플로우를 개발하고 있다고 말했습니다.하원 청문회에서는 보안 문제가 최우선 과제로 다뤄졌으며, 의원들은 AI 능력의 위험성과 적대국들의 모델 역공학 가능성에 대해 질문했고, 길은 속도가 성공에 매우 중요하다고 강조하며 “우리는 생명이 달린 것처럼 행동해야 합니다”라고 말했습니다.
630 조회
0 추천
2025.12.11 등록
Microsoft는 2025년 1월부터 9월까지 3,750만 건의 익명화된 대화를 분석한 최초의 포괄적인 Copilot 사용 연구를 발표했으며, 사용자들이 단순히 생산성 도움만이 아닌 건강, 관계, 인생 결정에 대한 개인적인 지침을 점점 더 많이 찾고 있다는 사실을 밝혔습니다.연구는 데스크톱과 모바일 사용자 간의 뚜렷한 차이를 발견했는데, 데스크톱 사용자는 Copilot을 생산성 도구로 취급한 반면 모바일 사용자는 “대화형 동반자”로 활용했으며, 건강 관련 주제가 하루 중 모든 시간대의 대화를 지배했습니다.Microsoft의 책임 있는 AI 책임자는 사용자들이 그러한 목적으로 설계되지 않은 도구에서 정서적 지원을 구함에 따라 안전 문제를 인정했으며, OpenAI, Google, Meta, Anthropic과 장기 챗봇 사용자를 두고 경쟁하는 가운데 “필요한 통제와 보호 장치”의 필요성을 강조했습니다.
617 조회
0 추천
2025.12.11 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입