AI 뉴스

구글 '나노바나나' 정체 공개...새 AI 이미지 편집 모델 출시

aIer

2025.08.27 09:50

481

1

0

구글이 AI 이미지 모델을 대폭 업그레이드한 'Gemini 2.5 Flash Image'를 출시하며 자연어 명령으로 이미지를 생성하고 기존 사진을 병합하며 이상한 왜곡 없이 정밀 편집할 수 있는 기능을 제공한다고 발표했다.

이번 업그레이드는 업계 선두인 오픈AI(OpenAI)와의 격차를 줄이려는 시도로, ChatGPT가 7억 명의 주간 사용자를 보유한 반면 구글 Gemini는 4억 5천만 명의 월간 사용자에 머물러 있다. 구글은 여러 편집 과정에서 캐릭터나 객체의 일관성을 유지하는 AI의 가장 큰 난제 중 하나를 해결했다고 밝혔으며, 사용자가 간단한 명령으로 배경 흐리기, 티셔츠 얼룩 제거, 자세 변경, 흑백 사진에 색상 추가 등의 세밀한 작업을 할 수 있다고 설명했다.

공식 출시 전 이 모델은 크라우드소싱 평가 플랫폼 LMArena에서 'nano-banana'라는 익명으로 등장해 샘 알트만(Sam Altman)의 셔츠 색깔을 바꾸는 등 놀라운 성능을 보여주며 화제가 됐다. 새 모델은 Gemini 앱뿐만 아니라 개발자들이 Gemini API, 구글 AI 스튜디오, Vertex AI를 통해 접근할 수 있으며, 부동산 목록 카드, 직원 유니폼 배지, 제품 목업 제작 등 실제 사용 사례에서 활용되고 있다.

링크

https://developers.googleblog.com/en/introducing-gemini-2-5-flash-image/

144 회 연결

댓글 0

로그인한 회원만 댓글 등록이 가능합니다.

전체 329 / 56 페이지

Mady by Google Event - 제미나이 라이브 업데이트

20일 구글은 Made by google 행사를 열었다. 이 자리에서 주로 Pixel 폰과 관련된 내용이 발표되었지만,인공지능 Gemini 의 픽셀 연결 버전 "제미나이 라이브" 와 관련된 업데이트가 있었다..https://blog.google/products/gemini/gemini-live-updates-august-2025/주요 동영상은 위 주소에서 확인이 가능하다.이번 업데이트로 Gemini Live는 더욱 시각적으로 인지력이 높아졌고, 화면에서 실시간으로 사용자에게 시각적 가이드(예: 화면에 중요한 부분 하이라이트)를 제공한다.예를 들어 신발 두 켤레 중 어느 것이 더 잘 어울리는지, 또는 적절한 공구가 무엇인지 Gemini가 화면을 보며 직접 알려줄 수 있다 이 시각적 가이드 기능은 8월 28일 출시되는 Pixel 10 시리즈에 먼저 적용되며, 이후 안드로이드 및 iOS 기기로 확장될 예정이다.Gemini Live는 구글 캘린더, 킵, 테스크 등 기존 앱뿐 아니라 곧 메시지, 전화, 시계, 지도 앱과도 더 깊게 통합되어 스케줄 관리, 메시지 전송 등의 실생활 업무를 돕는다.예를 들어 생일 선물을 찾다가 바로 가족에게 전화를 걸거나, 지하철 경로를 찾으면서 메시지를 바로 보내는 등 대화하면서 여러 앱을 넘나드는 지원이 가능해진다.음성 대화 품질도 크게 개선되어 어조, 리듬, 음높이 등을 자연스럽게 사용해 스트레스 상황에도 차분한 반응을 하는 등 보다 인간다운 대화가 가능해진다.사용자 요청에 따라 말하는 속도를 조절하거나, 재미있는 악센트로 이야기해주는 기능과, 인물 시점의 생생한 스토리텔링 기능도 곧 선보인다.이번 업데이트는 Gemini를 더 자연스럽고 도움이 되는 AI 비서로 만들기 위한 구글의 지속적인 노력의 일환이며, 앞으로도 사용자와 함께 발전시켜 나가겠다는 계획이다.

529

0

2025.08.21

개발자 AI 활용 트렌드 분석 인사이트를 보니… ‘Claude’ ‘Python’이… 1

구름 측은 “‘Stack Overflow Developer Survey 2025’의 리서치에 따르면 개발자는 10명중 8명이 이미 업무에 AI 도구를 활용하고 있다”며 “AI 코드 어시스턴트를 사용하는 기업 소프트웨어 엔지니어가 2023년 초에는 10% 미만에 불과했지만, 2028년에는 75%까지 증가할 전망이며, 이는 곧 AI 활용 능력이 개발자의 필수 역량으로 자리잡고 있음을 보여준다”고 설명했다.개발자가 코딩에 가장 많이 활용하는 LLM은 Claude(42%), ChatGPT(21%), Gemini(16%) 순으로 Claude가 코딩분야에서는 ChatGPT를 제치고 1위로 부상했다. LLM에 가장 많이 활용되는 개발언어는 Python이다.https://www.tech42.co.kr/%ea%b5%ac%eb%a6%84-%ea%b8%80%eb%a1%9c%eb%b2%8c-%ea%b0%9c%eb%b0%9c%ec%9e%90-ai-%ed%99%9c%ec%9a%a9-%ed%8a%b8%eb%a0%8c%eb%93%9c-%eb%b6%84%ec%84%9d-%ec%9d%b8%ec%82%ac%ec%9d%b4%ed%8a%b8%eb%a5%bc-%eb%b3%b4/

707

0

2025.08.21

MIT 보고서 "기업 생성형 AI 시범사업 95% 실패"...수익 창출 미달

MIT 연구진이 기업의 생성형 AI 시범사업 중 95%가 수익 창출에 실패했다는 충격적인 연구 결과를 발표했다.18일(현지시간) 포춘지에 따르면, MIT 미디어랩 NANDA 이니셔티브가 발표한 '생성형 AI 격차: 2025년 비즈니스 AI 현황' 보고서는 대부분의 기업 AI 프로젝트가 기대에 못 미치는 성과를 거두고 있다고 밝혔다.연구진은 95%의 기업에서 생성형 AI 구현이 부진한 핵심 원인이 AI 모델의 품질이 아니라 도구와 조직 모두의 '학습 격차'에 있다고 분석했다. 경영진들이 종종 규제나 모델 성능을 탓하지만, MIT 연구는 잘못된 기업 통합 방식을 지적했다.생성형 AI 예산의 절반 이상이 영업 및 마케팅 도구에 투입되고 있지만, MIT는 백오피스 자동화에서 가장 큰 투자수익률을 발견했다. 성공적인 AI 배포의 비결은 도입 방식에 있다. 전문 업체로부터 AI 도구를 구매하고 파트너십을 구축하는 방식은 약 67%의 성공률을 보인 반면, 내부 개발은 3분의 1 정도의 성공률만을 기록했다.

517

0

2025.08.21

구글 포토, 음성으로 사진 편집하는 AI 기능 도입

구글 포토에 드디어 음성으로 사진집이 가능해졌습니다. AI 편집기능이 추가된 것입니다."이 사진을 더 좋게 만들어줘"라고 말하면 자동으로 편집해준다고 합니다. 편집 스킬이 부족한 사람들한테 정말 유용한 기능일 것 같습니다.특히 C2PA 표준 도입으로 AI로 편집했는지 원본인지 구분할 수 있게 된 점이 인상적입니다. 딥페이크나 가짜 이미지를 걸러낼 수 있는 기능입니다.구글 픽셀 10(Pixel 10)부터 시작해서 iOS와 안드로이드 구글포토로 점진적을 확대될 예정이라고 합니다.

515

0

2025.08.21

내일은 대박날거야

데이지

0:00

0:00

최신 차트 (10)

내일은 대박날거야

데이지
햇살이 날 비추고

데이지
가을비

SH5
월요병

윤가용
티라노사우르스

SH5
오늘 강원도에 비온다는데

SH5
SUNO는 한국 드라마도 시청하나봄.…

SH5
즐거운 금요일 이다~!

지훈89
기아 타이거즈 응원가 하나 더

zibbh_11
야구팀 응원가도 생성 가능 '기아 타…

zibbh_11