AI 뉴스

Gemini 앱, 사진 기반 비디오 생성 기능 추가

페이지 정보

작성자 xtalfi
작성일 2025.11.15 14:24
839 조회
0 추천
0 비추천

본문

Google-Veo-3.1-2.jpg

(퍼플렉시티가 정리한 기사)


구글은 Gemini 앱에 새로운 기능을 도입한다고 목요일에 발표했다. 이 기능은 사용자가 최대 세 개의 참조 이미지를 업로드하여 AI 기반 영상 생성에 활용할 수 있도록 한다. 구글이 "비주얼 인그리디언트"라고 부르는 이 업데이트는 복잡한 텍스트 프롬프트를 작성하지 않아도 일관된 캐릭터, 스타일, 그리고 장면을 가진 영상을 만들 수 있게 해준다.​

이 기능은 구글의 최신 영상 생성 모델인 Veo 3.1을 활용하며, 기존 Flow 영상 편집 도구와 함께 Gemini 앱에서 바로 사용할 수 있다. 9to5Google에 따르면, 해당 업데이트는 목요일부터 점진적으로 배포되고 있으며, 다음 주에 Google AI Plus, Pro, Ultra 구독자에게 전체 제공될 전망이다.​


비디오 제작 간소화

시각적 요소 기능은 세 가지 주요 창작 과제를 해결합니다: 다양한 장면에서 캐릭터 일관성 유지, 특정 질감과 예술적 스타일을 비디오로 전환, 그리고 사용자의 맞춤 제작 세계와 객체 일치 보장. Google은 이 기능을 AI 비디오 생성에 전통적으로 필요했던 길고 복잡한 텍스트 프롬프트에 대한 의존도를 줄이는 방법으로 포지셔닝하고 있습니다.​

참조 이미지는 캐릭터, 객체, 스타일 또는 장면을 묘사할 수 있으며, Veo 3.1은 사용자의 텍스트 지침에 따라 이를 생성된 비디오에 통합합니다. 이 접근 방식은 5월 출시 이후 2억 7,500만 개 이상의 비디오를 제작하는 데 사용된 Google의 전용 AI 영화 제작 도구인 Flow에서 이미 사용 가능한 기능을 반영합니다.​

10월 중순에 출시된 Veo 3.1은 이전 버전에 비해 더 풍부한 오디오 생성, 더 강력한 프롬프트 준수, 그리고 더 나은 이미지-비디오 변환 품질을 포함한 여러 개선 사항을 제공합니다. 이 모델은 이제 비디오와 함께 동기화된 오디오를 생성할 수 있으며 여러 샷에 걸쳐 캐릭터 일관성을 유지하기 위해 참조 이미지를 지원합니다.​


구독 및 경쟁

시각적 재료 기능은 구글의 AI 플러스, 프로, 울트라 요금제 가입자들에게 제공될 예정입니다. 구글 AI 프로는 월 20달러이며, 울트라는 월 249.99달러이고 가장 높은 사용 한도와 Veo 3에 대한 접근 권한이 포함되어 있습니다. 회사의 Gemini 앱은 최근 월간 활성 사용자 수가 6억 5천만 명을 돌파했으며, 이는 3월의 3억 5천만 명에서 증가한 수치입니다.​

이번 업데이트는 구글이 AI 영상 생성 분야에서 점점 치열해지는 경쟁에 직면한 가운데 이루어진 것입니다. 최근 오픈AI가 Sora 2를 출시했고, 메타는 Movie Gen 도구를 개발 중입니다. 구글 또한 최근 100만 달러 상금의 AI 영화 대회를 발표했으며, 참가자는 최소 70% 이상 구글 AI로 생성한 콘텐츠를 사용해야 합니다.

댓글 0
전체 1,366 / 85 페이지
Google은 미국 외 지역에서 최대 규모의 인공지능 인프라 하드웨어 엔지니어링 센터를 대만에 개설했으며, 라이칭더 총통은 이번 조치가 대만이 신뢰할 수 있는 기술 파트너이자 안전한 AI 개발을 위한 핵심 허브임을 입증하는 것이라고 설명했다.타이베이에 위치한 이 시설은 매일 수십억 명의 사람들이 사용하는 기기에 전력을 공급하는 전 세계 Google 데이터 센터에 배치되는 기술을 개발하고 테스트할 예정이라고 Google Cloud 부사장 아머 마흐무드가 밝혔다.대만은 전 세계 반도체의 60% 이상, 최첨단 칩의 90% 이상을 생산하고 있으며, AI 수요가 급증하는 가운데 TSMC만으로도 계약 칩 제조 분야에서 64%의 글로벌 시장 점유율을 차지하고 있다.
727 조회
0 추천
2025.11.20 등록
**마이크로소프트(Microsoft)**의 AI CEO **무스타파 술레이만(Mustafa Suleyman)**은 Copilot과 Windows에 AI가 통합되는 것에 불만을 가진 비평가들에게 반박하며, 사람들이 AI와 유창하게 대화하고 이미지와 동영상을 생성할 수 있는 능력에 감명을 받지 않는다는 사실에 “정말 놀랐다”고 말했다.술레이만의 옹호는 최근 The Verge의 보고서에서 실제 Copilot의 기능이 **마이크로소프트(Microsoft)**가 광고에서 보여주는 것과 맞지 않는다는 점이 지적된 가운데 나왔으며, Windows 사장 **파반 다불루리(Pavan Davuluri)**가 “대리 OS(agentic OS)” 비전을 홍보하다가 심한 반발을 받아 자신의 게시물에서 답글 기능을 비활성화해야 했던 사건에 이어졌다.이 논란은 **마이크로소프트(Microsoft)**가 새로운 “AI를 위한 당신의 캔버스(Your canvas for AI)” 슬로건을 밀어붙이는 가운데, Windows의 평판이 해당 매체가 “역대 최저”라고 묘사할 정도로 떨어진 상황을 부각시킨다. 사용자들은 모든 인터페이스에 원하지 않는 AI 기능을 강제로 넣는 대신 회사가 근본적인 플랫폼 문제를 해결할 것을 요구하고 있다.
738 조회
0 추천
2025.11.20 등록
Google DeepMind는 Boston Dynamics의 전 최고기술책임자(CTO)인 Aaron Saunders를 하드웨어 엔지니어링 부사장으로 영입했습니다. 이는 CEO Demis Hassabis가 Gemini를 Android가 여러 제조업체의 스마트폰을 구동하는 것처럼 범용 로봇 운영체제로 변모시키려는 비전을 발전시키기 위한 것입니다.Hassabis는 Gemini가 “거의 모든 물리적 구성으로 즉시 작동할 수 있는” AI 기반으로 기능하기를 목표로 하며, 이는 인간형 및 비인간형 로봇을 포함하여 회사가 AI 기반 로봇공학 분야로의 진출을 강화하고 있는 가운데 추진되고 있습니다.이러한 움직임은 Google DeepMind를 2035년까지 510억 달러 규모에 달할 것으로 예상되는 급속히 성장하는 시장에서 경쟁할 수 있는 위치에 올려놓습니다. 경쟁사인 Tesla는 향후 10년간 백만 대의 Optimus 인간형 로봇 생산을 목표로 하고 있으며, Unitree와 같은 중국 기업들은 경쟁력 있는 가격의 다리 달린 로봇을 제공하고 있습니다
707 조회
0 추천
2025.11.20 등록
MIT 연구원들은 새로운 추론 AI 모델에서 가장 많은 연산 처리를 요구하는 문제 유형이 인간이 해결하는 데 가장 오래 걸리는 문제와 동일하다는 것을 발견했으며, 이는 인공지능과 생물학적 지능이 복잡한 사고에 접근하는 방식에서 예상치 못한 수렴을 시사합니다PNAS에 게재된 이 연구는 7가지 문제 유형에 걸쳐 인간의 반응 시간과 AI가 생성한 “토큰”(내부 연산 단계)을 측정했으며, 놀라운 상관관계를 발견했습니다—인간과 모델 모두 “ARC 챌린지“라고 불리는 시각적 추론 과제에 가장 오래 걸리고 기본 산술에는 가장 적은 노력을 소비했습니다추론 모델은 훈련 중 강화 학습을 통해 향상된 성능을 달성하는데, 정답에 대해서는 보상을 받고 오류에 대해서는 페널티를 받아 문제 공간을 탐색하고 인간의 문제 해결 접근 방식을 반영하는 단계별 솔루션 전략을 개발할 수 있습니다
732 조회
0 추천
2025.11.20 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입