Loading...

AI 뉴스

Grok, X에 이미지-투-비디오 도구 추가

페이지 정보

작성자 xtalfi
작성일 2025.11.11 14:52
1,487 조회
0 추천
0 비추천

본문

Grok-logo-on-an-Android-phone-with-an-AI-type-background_cpf6o8.jpg

(퍼플렉시티가 정리한 기사)


일론 머스크는 11월 8일 Grok의 새로운 이미지-비디오 애니메이션 기능을 공개했으며, 사용자들이 간단한 길게 누르기 제스처와 맞춤형 텍스트 프롬프트를 통해 정지 사진을 짧은 비디오 클립으로 변환할 수 있게 했다. Grok Imagine 도구로 구동되는 이 기능은 X에 직접 통합되어 사용자들이 플랫폼에서 AI 생성 비디오 콘텐츠를 만들 수 있도록 한다.​

토요일 아침 일찍 X에서 이 도구를 시연하며, 머스크는 정지 이미지에서 생성된 "I will always love you"라고 말하는 여성의 AI 생성 비디오를 게시했다. 그는 나중에 두 사람이 머펫으로 변하는 또 다른 예시를 공유하며 다음과 같이 썼다: "어떤 이미지든 길게 눌러서 비디오로 만드세요! 그런 다음 프롬프트를 맞춤 설정하여 상상할 수 있는 모든 것을 만들어보세요".​


Grok 4 플랫폼과의 통합

비디오 생성 기능은 2025년 10월 버전 0.9로 업그레이드된 xAI의 Grok Imagine 도구를 기반으로 합니다. 이 시스템은 배경 음악, 대화 및 음향 효과를 포함한 동기화된 오디오와 함께 6초에서 15초 범위의 비디오를 생성할 수 있습니다. 보고서에 따르면, Grok Imagine을 구동하는 Aurora 엔진은 평균 약 17초 만에 비디오를 생성하여 Adobe, Google 및 OpenAI의 도구들과 경쟁력 있는 위치를 차지하고 있습니다.​

Grok 4는 2025년 8월 전 세계 모든 사용자에게 무료로 제공되었지만, 무료 등급에는 12시간마다 약 5회의 쿼리 제한을 포함한 사용 제한이 있습니다. 프리미엄 구독자 및 Premium+ 플랜 사용자는 더 빠른 응답 시간, 확장된 컨텍스트 길이 및 고급 SuperGrok 모드에 대한 액세스를 받습니다. 월 $300의 비용이 드는 SuperGrok Heavy 구독은 모델의 최고 성능 버전을 제공합니다.​


경쟁 환경

이번 출시로 xAI는 기존 AI 영상 생성 플랫폼들과 직접적인 경쟁 관계에 놓이게 되었습니다. Adobe는 Firefly 도구를 통해 유사한 이미지-투-비디오 기능을 제공하며, 정지 이미지를 실사 영상으로 변환할 수 있습니다. Google의 Veo 3와 OpenAI의 Sora는 모두 동기화된 오디오와 함께 AI 생성 영상을 제작하지만, 해상도, 길이, 생성 속도 면에서 각기 다른 강점을 가지고 있습니다.​

머스크의 발표 이후, X 사용자들은 빠르게 이 기능을 실험하기 시작했으며, 플랫폼 전반에 걸쳐 AI 생성 클립을 공유했습니다. 이 도구는 X 플랫폼과 Grok의 독립형 모바일 애플리케이션 모두를 통해 이용할 수 있습니다.

댓글 0
전체 1,366 / 32 페이지
• Google의 Gemini [GOOG -0.51%] AI 어시스턴트는 이번 주에 새로운 자동 화면 컨텍스트 기능의 출시를 시작했으며, 이 기능은 사용자가 관련 질문을 할 때 화면의 콘텐츠를 자동으로 캡처하고 분석하여 “화면에 대해 물어보기” 버튼을 수동으로 탭할 필요를 없애줍니다• 이 기능은 언어 단서를 사용하여 “이 오류는 무엇을 의미하나요?” 또는 “이 글을 요약해 주세요”와 같은 화면 관련 프롬프트를 감지하며, 앱, 이미지 및 동영상 전반에서 작동합니다. 다만 초기 테스트 결과 이러한 쿼리를 약 50%의 정확도로 식별하는 것으로 나타났습니다.• 사용자는 Gemini 설정을 통해 자동 스크린샷 기능을 비활성화할 수 있으며, Android의 FLAG_SECURE 보호 기능은 뱅킹 앱, 스트리밍 서비스 및 비공개 브라우징 모드가 캡처에서 제외되도록 보장합니다.
733 조회
0 추천
2025.12.17 등록
• Google [GOOG -0.51%]은 12월 16일 Opal 워크플로우 빌더를 Gemini 웹 앱에 통합하여, 사용자들이 Super Gems라는 새로운 기능을 통해 코딩 없이 AI 기반 미니 애플리케이션을 만들 수 있도록 했습니다.• 이 통합은 Opal을 Gemini의 Gems Manager에 통합하며, 자연어 설명을 자동 생성된 단계와 인터페이스 요소가 포함된 시각적 워크플로우로 변환하는 Workflow Builder를 제공하고, 이는 공유 가능한 링크를 통해 게시될 수 있습니다.• 현재 출시는 미국 사용자로 제한되어 있으며, 이는 Google이 Gemini를 맞춤형 AI 도구 구축을 위한 중앙 플랫폼으로 포지셔닝하면서 다른 Labs 통합과 동일한 단계적 접근 방식을 따르고 있습니다.
790 조회
0 추천
2025.12.17 등록
• Jeff Li는 Super Data Science 팟캐스트에서 Netflix, Spotify, DoorDash에서 데이터 과학자로 근무한 경험을 바탕으로, 워크플로우에 대한 사전 인간 숙달 없이는 AI 자동화가 실패한다고 주장합니다 (https://www.youtube.com/watch?v=T7zG5-9-zIw).• Li가 AI 이미지 생성을 사용하여 광고 제작을 자동화하려던 시도는 크리에이티브 디자인에 대한 전문 지식이 부족하여 실패했으며, 그의 기술적 역량과 광고 업계 배경에도 불구하고 고객들은 제작된 광고를 “형편없다”고 평가했습니다[big-agile +1].• 여러 산업 분야의 연구는 AI 시스템이 새로운 실패와 예외 상황을 처리하기 위해 인간의 판단과 도메인 전문 지식을 필요로 한다는 것을 확인하며, 운영자가 효과적으로 개입할 수 있는 조직적 지식이 부족할 때 자동화가 불충분하다는 것을 입증합니다[big-agile +1].
739 조회
0 추천
2025.12.17 등록
OpenAI는 화요일에 GPT Image 1.5를 공개했으며, 이는 최대 4배 빠른 이미지 생성 속도와 수정 전반에 걸쳐 시각적 일관성을 유지하는 향상된 편집 기능을 제공합니다. 이는 CEO Sam Altman의 최근 “코드 레드” 선언 이후 Google로부터 입지를 되찾기 위한 노력의 일환입니다.원래 1월 초에 계획되었던 이 가속화된 출시는 Google의 Gemini 3와 입소문을 탄 Nano Banana Pro 이미지 생성기의 경쟁 압력에 대응한 것으로, 이는 10월까지 Gemini가 월 6억 5천만 명의 사용자를 확보하는 데 기여했습니다.새로운 모델은 현재 모든 ChatGPT 사용자와 API를 통해 이용 가능하며, Fidji Simo, OpenAI의 애플리케이션 CEO에 따르면 사전 설정 필터와 인기 프롬프트를 갖춘 “크리에이티브 스튜디오처럼” 작동하는 전용 사이드바 탭을 특징으로 합니다.
737 조회
0 추천
2025.12.17 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입