Loading...

AI 뉴스

Gemini 앱, 사진 기반 비디오 생성 기능 추가

페이지 정보

작성자 xtalfi
작성일 2025.11.15 14:24
1,017 조회
0 추천
0 비추천

본문

Google-Veo-3.1-2.jpg

(퍼플렉시티가 정리한 기사)


구글은 Gemini 앱에 새로운 기능을 도입한다고 목요일에 발표했다. 이 기능은 사용자가 최대 세 개의 참조 이미지를 업로드하여 AI 기반 영상 생성에 활용할 수 있도록 한다. 구글이 "비주얼 인그리디언트"라고 부르는 이 업데이트는 복잡한 텍스트 프롬프트를 작성하지 않아도 일관된 캐릭터, 스타일, 그리고 장면을 가진 영상을 만들 수 있게 해준다.​

이 기능은 구글의 최신 영상 생성 모델인 Veo 3.1을 활용하며, 기존 Flow 영상 편집 도구와 함께 Gemini 앱에서 바로 사용할 수 있다. 9to5Google에 따르면, 해당 업데이트는 목요일부터 점진적으로 배포되고 있으며, 다음 주에 Google AI Plus, Pro, Ultra 구독자에게 전체 제공될 전망이다.​


비디오 제작 간소화

시각적 요소 기능은 세 가지 주요 창작 과제를 해결합니다: 다양한 장면에서 캐릭터 일관성 유지, 특정 질감과 예술적 스타일을 비디오로 전환, 그리고 사용자의 맞춤 제작 세계와 객체 일치 보장. Google은 이 기능을 AI 비디오 생성에 전통적으로 필요했던 길고 복잡한 텍스트 프롬프트에 대한 의존도를 줄이는 방법으로 포지셔닝하고 있습니다.​

참조 이미지는 캐릭터, 객체, 스타일 또는 장면을 묘사할 수 있으며, Veo 3.1은 사용자의 텍스트 지침에 따라 이를 생성된 비디오에 통합합니다. 이 접근 방식은 5월 출시 이후 2억 7,500만 개 이상의 비디오를 제작하는 데 사용된 Google의 전용 AI 영화 제작 도구인 Flow에서 이미 사용 가능한 기능을 반영합니다.​

10월 중순에 출시된 Veo 3.1은 이전 버전에 비해 더 풍부한 오디오 생성, 더 강력한 프롬프트 준수, 그리고 더 나은 이미지-비디오 변환 품질을 포함한 여러 개선 사항을 제공합니다. 이 모델은 이제 비디오와 함께 동기화된 오디오를 생성할 수 있으며 여러 샷에 걸쳐 캐릭터 일관성을 유지하기 위해 참조 이미지를 지원합니다.​


구독 및 경쟁

시각적 재료 기능은 구글의 AI 플러스, 프로, 울트라 요금제 가입자들에게 제공될 예정입니다. 구글 AI 프로는 월 20달러이며, 울트라는 월 249.99달러이고 가장 높은 사용 한도와 Veo 3에 대한 접근 권한이 포함되어 있습니다. 회사의 Gemini 앱은 최근 월간 활성 사용자 수가 6억 5천만 명을 돌파했으며, 이는 3월의 3억 5천만 명에서 증가한 수치입니다.​

이번 업데이트는 구글이 AI 영상 생성 분야에서 점점 치열해지는 경쟁에 직면한 가운데 이루어진 것입니다. 최근 오픈AI가 Sora 2를 출시했고, 메타는 Movie Gen 도구를 개발 중입니다. 구글 또한 최근 100만 달러 상금의 AI 영화 대회를 발표했으며, 참가자는 최소 70% 이상 구글 AI로 생성한 콘텐츠를 사용해야 합니다.

댓글 0
전체 1,366 / 46 페이지
Runway는 월요일에 Gen 4.5를 공개했으며, 이는 독립 벤치마킹 업체 Artificial Analysis가 관리하는 Video Arena 리더보드에서 1위를 차지한 새로운 AI 비디오 생성 모델로, 2위인 Google의 Veo 3 모델과 7위인 OpenAI의 Sora 2 Pro를 능가했다.PitchBook에 따르면 35억 5천만 달러의 가치를 평가받은 이 100명 규모의 스타트업은 블라인드 테스트를 사용하며, 투표자들이 어느 회사가 제작했는지 모르는 상태에서 비디오 결과물을 비교하여 순수한 사용자 선호도를 기반으로 편향되지 않은 순위를 보장한다.CEO Cristóbal Valenzuela는 CNBC에 Runway가 “100명의 팀으로 수조 달러 규모의 기업들을 능가하는 데 성공했다”고 말했으며, “David”라는 코드명의 이 모델은 주말까지 회사의 플랫폼, API 및 파트너 통합을 통해 모든 고객에게 제공될 예정이다.
600 조회
0 추천
2025.12.02 등록
Google은 12월 8일 오전 10시(태평양 표준시)에 30분간 라이브스트림을 개최하여 확장 현실 플랫폼인 Android XR의 업데이트를 공개할 예정이며, Gemini AI 통합이 적용된 헤드셋 및 스마트 안경의 새로운 기능에 중점을 둘 것입니다.이 행사는 10월에 출시된 Samsung의 Galaxy XR 헤드셋 출시에 이어 진행되는 것으로, 이는 1,799달러 가격의 첫 번째 Android XR 기기로서 4K 디스플레이와 손동작, 시선 추적, 음성 명령을 통한 AI 기반 상호작용을 특징으로 합니다.티저 자료에 따르면 Google은 2026년 출시 예정인 Samsung의 차기 스마트 안경을 선보일 가능성이 있으며, 이는 Apple의 부진한 Vision Pro 및 Meta의 보다 성공적인 Ray-Ban 스마트 안경과 경쟁하기 위한 것입니다.
602 조회
0 추천
2025.12.02 등록
• 한국 정부는 엔비디아로부터 약 1만3천 개의 GPU를 공급받아 국내 반입을 완료했으며, 이는 지난 5월 추경예산에서 확보한 1조4600억 원으로 집행됐다고 과학기술정보통신부가 1일 밝혔다.• 도입된 GPU에는 최신 B200 모델과 이전 세대 제품이 포함되어 있으며, 정부는 내년 초부터 대학·연구소·스타트업 등에 우선 배정하고 공공 분야에도 투입할 계획이다.• 이는 젠슨 황 CEO가 지난 10월 방한 시 약속한 총 26만여 장 규모(정부 5만 개, 삼성·SK·현대차 각 최대 5만 개, 네이버클라우드 6만 개)의 GPU 공급 계획 중 첫 물량이다.
625 조회
0 추천
2025.12.02 등록
Persistent Systems의 Dattaraj Rao는 VentureBeat에서 온톨로지(기업 맞춤형 개념, 계층 구조, 관계의 정의)가 AI 에이전트가 엔터프라이즈 데이터와 프로세스를 오해하지 않도록 필수적인 가드레일 역할을 한다고 주장합니다. 수십억 달러가 에이전트 인프라에 투자되었음에도 불구하고 실제 성공 사례는 제한적이라는 점을 지적합니다.기사에서는 엔터프라이즈 데이터의 단편화로 인해 중요한 모호성이 발생하는데, 예를 들어 “고객”이라는 단어가 Sales CRM에서는 한 종류의 사람을, 재무 시스템에서는 또 다른 종류의 사람을 의미할 수 있기 때문에, Neo4j와 같은 그래프 데이터베이스를 활용한 온톨로지 기반 접근 방식이 에이전트가 내장된 비즈니스 규칙을 따르면서 질의할 수 있는 통합된 진실의 원천을 마련해야 한다고 설명합니다.이러한 온톨로지 기반 아키텍처는 시급한 엔터프라이즈 과제를 해결합니다. AI의 환각(hallucination) 현상은 기업에게 큰 컴플라이언스와 의사결정 리스크를 야기할 수 있으며, 기술에 대한 관심이 빠르게 증가하고 있음에도 불구하고 실제로 에이전트 기반 AI 워크플로우를 성공적으로 확장한 기업은 11%에 불과하다고 밝혔습니다.
607 조회
0 추천
2025.12.01 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입