Loading...

AI 뉴스

Gemini 앱, 사진 기반 비디오 생성 기능 추가

페이지 정보

작성자 xtalfi
작성일 2025.11.15 14:24
1,097 조회
0 추천
0 비추천

본문

Google-Veo-3.1-2.jpg

(퍼플렉시티가 정리한 기사)


구글은 Gemini 앱에 새로운 기능을 도입한다고 목요일에 발표했다. 이 기능은 사용자가 최대 세 개의 참조 이미지를 업로드하여 AI 기반 영상 생성에 활용할 수 있도록 한다. 구글이 "비주얼 인그리디언트"라고 부르는 이 업데이트는 복잡한 텍스트 프롬프트를 작성하지 않아도 일관된 캐릭터, 스타일, 그리고 장면을 가진 영상을 만들 수 있게 해준다.​

이 기능은 구글의 최신 영상 생성 모델인 Veo 3.1을 활용하며, 기존 Flow 영상 편집 도구와 함께 Gemini 앱에서 바로 사용할 수 있다. 9to5Google에 따르면, 해당 업데이트는 목요일부터 점진적으로 배포되고 있으며, 다음 주에 Google AI Plus, Pro, Ultra 구독자에게 전체 제공될 전망이다.​


비디오 제작 간소화

시각적 요소 기능은 세 가지 주요 창작 과제를 해결합니다: 다양한 장면에서 캐릭터 일관성 유지, 특정 질감과 예술적 스타일을 비디오로 전환, 그리고 사용자의 맞춤 제작 세계와 객체 일치 보장. Google은 이 기능을 AI 비디오 생성에 전통적으로 필요했던 길고 복잡한 텍스트 프롬프트에 대한 의존도를 줄이는 방법으로 포지셔닝하고 있습니다.​

참조 이미지는 캐릭터, 객체, 스타일 또는 장면을 묘사할 수 있으며, Veo 3.1은 사용자의 텍스트 지침에 따라 이를 생성된 비디오에 통합합니다. 이 접근 방식은 5월 출시 이후 2억 7,500만 개 이상의 비디오를 제작하는 데 사용된 Google의 전용 AI 영화 제작 도구인 Flow에서 이미 사용 가능한 기능을 반영합니다.​

10월 중순에 출시된 Veo 3.1은 이전 버전에 비해 더 풍부한 오디오 생성, 더 강력한 프롬프트 준수, 그리고 더 나은 이미지-비디오 변환 품질을 포함한 여러 개선 사항을 제공합니다. 이 모델은 이제 비디오와 함께 동기화된 오디오를 생성할 수 있으며 여러 샷에 걸쳐 캐릭터 일관성을 유지하기 위해 참조 이미지를 지원합니다.​


구독 및 경쟁

시각적 재료 기능은 구글의 AI 플러스, 프로, 울트라 요금제 가입자들에게 제공될 예정입니다. 구글 AI 프로는 월 20달러이며, 울트라는 월 249.99달러이고 가장 높은 사용 한도와 Veo 3에 대한 접근 권한이 포함되어 있습니다. 회사의 Gemini 앱은 최근 월간 활성 사용자 수가 6억 5천만 명을 돌파했으며, 이는 3월의 3억 5천만 명에서 증가한 수치입니다.​

이번 업데이트는 구글이 AI 영상 생성 분야에서 점점 치열해지는 경쟁에 직면한 가운데 이루어진 것입니다. 최근 오픈AI가 Sora 2를 출시했고, 메타는 Movie Gen 도구를 개발 중입니다. 구글 또한 최근 100만 달러 상금의 AI 영화 대회를 발표했으며, 참가자는 최소 70% 이상 구글 AI로 생성한 콘텐츠를 사용해야 합니다.

댓글 0
전체 1,366 / 30 페이지
OpenAI는 수요일에 앱 디렉토리를 공개하고 ChatGPT에 대한 개발자 앱 제출을 개시했으며, 이를 통해 사용자는 이용 가능한 도구를 탐색하고 개발자는 회사가 최근 출시한 SDK를 사용하여 새로운 인터랙티브 경험을 게시할 수 있게 되었다고 The Verge가 보도했습니다[theverge].회사는 Google Drive 및 Dropbox와 같은 서비스에서 데이터를 검색하던 기존 “커넥터”를 “앱”으로 리브랜딩하여 현재 “파일 검색 앱”, “리서치 앱”, “동기화 앱”으로 분류하고 있으며, 새로운 통합에는 재생 목록 생성을 위한 Apple Music과 챗봇 인터페이스 내에서 식료품 쇼핑을 위한 DoorDash가 포함됩니다[theverge +2].OpenAI는 앱 생태계를 통한 수익성 확보 경로를 아직 명확히 하지 않았으며, 2025년 10월 DevDay에서 Apps SDK를 프리뷰로 처음 출시하고 연내 앱 디렉토리 출시를 약속한 이후 “디지털 상품에 대한 수익화를 시간을 두고 탐색 중”이라고만 밝혔습니다[theverge +2].
560 조회
0 추천
2025.12.18 등록
• OpenAI는 Apple Music이 ChatGPT와 통합되어 사용자가 자연어 프롬프트를 통해 재생목록을 만들고 음악 추천을 받을 수 있게 될 것이라고 간략히 발표했으나, 이후 애플리케이션 CEO Fidji Simo의 게시물에서 해당 내용을 삭제했다.• 이 통합은 10월에 출시된 ChatGPT의 기존 Spotify 기능과 유사하게 작동하여, 사용자가 “Apple Music, 운동용 재생목록 만들어줘”와 같은 프롬프트로 대화를 시작하여 재생목록을 생성할 수 있게 한다.• 수정된 발표는 시기상조의 공개를 시사하며, OpenAI의 확장되는 앱 생태계의 일부로 음악 스트리밍 기능이 언제 출시될지에 대한 공식 일정은 제공되지 않았다.
584 조회
0 추천
2025.12.17 등록
• Google의 Gemini [GOOG -0.51%] AI 어시스턴트는 이번 주에 새로운 자동 화면 컨텍스트 기능의 출시를 시작했으며, 이 기능은 사용자가 관련 질문을 할 때 화면의 콘텐츠를 자동으로 캡처하고 분석하여 “화면에 대해 물어보기” 버튼을 수동으로 탭할 필요를 없애줍니다• 이 기능은 언어 단서를 사용하여 “이 오류는 무엇을 의미하나요?” 또는 “이 글을 요약해 주세요”와 같은 화면 관련 프롬프트를 감지하며, 앱, 이미지 및 동영상 전반에서 작동합니다. 다만 초기 테스트 결과 이러한 쿼리를 약 50%의 정확도로 식별하는 것으로 나타났습니다.• 사용자는 Gemini 설정을 통해 자동 스크린샷 기능을 비활성화할 수 있으며, Android의 FLAG_SECURE 보호 기능은 뱅킹 앱, 스트리밍 서비스 및 비공개 브라우징 모드가 캡처에서 제외되도록 보장합니다.
553 조회
0 추천
2025.12.17 등록
• Google [GOOG -0.51%]은 12월 16일 Opal 워크플로우 빌더를 Gemini 웹 앱에 통합하여, 사용자들이 Super Gems라는 새로운 기능을 통해 코딩 없이 AI 기반 미니 애플리케이션을 만들 수 있도록 했습니다.• 이 통합은 Opal을 Gemini의 Gems Manager에 통합하며, 자연어 설명을 자동 생성된 단계와 인터페이스 요소가 포함된 시각적 워크플로우로 변환하는 Workflow Builder를 제공하고, 이는 공유 가능한 링크를 통해 게시될 수 있습니다.• 현재 출시는 미국 사용자로 제한되어 있으며, 이는 Google이 Gemini를 맞춤형 AI 도구 구축을 위한 중앙 플랫폼으로 포지셔닝하면서 다른 Labs 통합과 동일한 단계적 접근 방식을 따르고 있습니다.
610 조회
0 추천
2025.12.17 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입