AI 뉴스

바이두, 2.4조 매개변수를 가진 ERNIE 5.0 AI 모델 공개

페이지 정보

작성자 xtalfi
작성일 2025.11.15 17:05
1,181 조회
0 추천
0 비추천

본문

50d4cf1c79fbfdc8ae75d90b42e8ddf3_1763193766_6477.png
(퍼플렉시티가 정리한 기사)


바이두는 목요일 베이징에서 열린 Baidu World 2025 컨퍼런스에서 네이티브 옴니모달 인공지능 기초 모델인 ERNIE 5.0을 공개했다. 중국의 기술 대기업은 점점 더 경쟁이 치열해지는 국내 AI 시장에서 주도권을 되찾기 위해 힘쓰고 있다.

이 모델은 2.4조개의 파라미터를 특징으로 하며, 텍스트, 이미지, 오디오, 비디오 데이터를 동시에 처리해 멀티모달 이해 및 생성 기능을 제공한다. ERNIE 5.0은 현재 ERNIE Bot에서 공개 프리뷰로 제공되며, 기업 고객은 바이두 AI 클라우드의 첸판(Qianfan) 플랫폼을 통해 이용 가능하다. 벤치마크 테스트에서, 회사 측은 이 모델이 Gemini 2.5 Pro와 GPT-5 등 글로벌 선도 모델들과 비슷한 성능을 보인다고 밝혔다.

로빈 리 CEO는 “기술적 혁신의 속도가 유일한 경쟁력의 해자”라고 강조하며, AI 애플리케이션이 기초 모델 자체의 가치를 100배로 창출하는 바이두의 비전을 제시했다. 회사는 또한 대규모 추론 시나리오를 위한 M100(2026년 초 출시 예정)과 초대형 모델 훈련을 위한 M300(2027년 초 출시 예정) 등 2종의 새로운 쿤룬 AI 칩도 공개했다.


제품 생태계 및 글로벌 확장

플래그십 모델 외에도 바이두는 AI 제품군 전반에 걸친 업그레이드를 발표했습니다. 범용 AI 에이전트인 GenFlow 3.0은 2천만 사용자에 도달하여 회사가 “세계 최대 범용 에이전트”라고 부르는 제품이 되었습니다. 또한 회사는 세계 최초의 상용 자체 진화 에이전트로 설명되는 Famou를 공개했으며, 이는 초대 코드를 통해 이용 가능하고 운송, 에너지, 금융 및 물류 분야의 복잡한 시나리오를 위해 설계되었습니다.

노코드 애플리케이션 빌더인 Miaoda는 버전 2.0으로 업그레이드되어 40만 개 이상의 애플리케이션을 생성했습니다. 국제 버전인 MeDo는 이번 행사에서 전 세계적으로 출시되었으며 현재 medo.dev에서 개발자들이 이용할 수 있습니다. 바이두의 AI 워크스페이스인 Oreate는 글로벌 시장에서 120만 명의 사용자를 확보했습니다. 회사의 디지털 휴먼 기술은 브라질에서 데뷔했으며 미국과 동남아시아로의 확장을 모색하고 있으며, 중국의 “광군제” 쇼핑 페스티벌 기간 동안 라이브 스트리머의 83%가 이 기술을 사용하여 참여 라이브 스트림이 전년 대비 119% 증가했습니다.


자율주행의 이정표

바이두의 자율주행 호출 서비스인 아폴로 고(Apollo Go)는 10월 31일 기준 전 세계적으로 누적 1,700만 건 이상의 탑승 횟수를 돌파했으며, 22개 도시에서 주간 25만 건 이상의 완전 무인 운행을 진행하고 있습니다. 이 서비스는 자율주행 누적 거리 2억 4천만 킬로미터 이상을 기록했으며, 이 중 1억 4천만 킬로미터는 완전 무인 모드로 운행되었습니다. 최근 아폴로 고는 아부다비에서 최초의 상업용 무인 운행 허가 중 하나를 획득했으며, 2026년까지 아랍에미리트 내 차량 규모를 수백 대로 확장할 계획을 세우고 있습니다.

이러한 발표에도 불구하고, 바이두는 광고 수익이 9월 분기에 약 8% 감소할 것으로 예상되어 거의 10년 만에 가장 큰 하락세에 직면해 있습니다. 업계 관계자들에 따르면, 바이두는 AI 기반 애플리케이션과 오픈소스 모델 개발 부문에서 국내 경쟁사인 바이트댄스, 알리바바에 뒤처지고 있습니다.


댓글 0
전체 1,366 / 30 페이지
OpenAI는 수요일에 앱 디렉토리를 공개하고 ChatGPT에 대한 개발자 앱 제출을 개시했으며, 이를 통해 사용자는 이용 가능한 도구를 탐색하고 개발자는 회사가 최근 출시한 SDK를 사용하여 새로운 인터랙티브 경험을 게시할 수 있게 되었다고 The Verge가 보도했습니다[theverge].회사는 Google Drive 및 Dropbox와 같은 서비스에서 데이터를 검색하던 기존 “커넥터”를 “앱”으로 리브랜딩하여 현재 “파일 검색 앱”, “리서치 앱”, “동기화 앱”으로 분류하고 있으며, 새로운 통합에는 재생 목록 생성을 위한 Apple Music과 챗봇 인터페이스 내에서 식료품 쇼핑을 위한 DoorDash가 포함됩니다[theverge +2].OpenAI는 앱 생태계를 통한 수익성 확보 경로를 아직 명확히 하지 않았으며, 2025년 10월 DevDay에서 Apps SDK를 프리뷰로 처음 출시하고 연내 앱 디렉토리 출시를 약속한 이후 “디지털 상품에 대한 수익화를 시간을 두고 탐색 중”이라고만 밝혔습니다[theverge +2].
552 조회
0 추천
2025.12.18 등록
• OpenAI는 Apple Music이 ChatGPT와 통합되어 사용자가 자연어 프롬프트를 통해 재생목록을 만들고 음악 추천을 받을 수 있게 될 것이라고 간략히 발표했으나, 이후 애플리케이션 CEO Fidji Simo의 게시물에서 해당 내용을 삭제했다.• 이 통합은 10월에 출시된 ChatGPT의 기존 Spotify 기능과 유사하게 작동하여, 사용자가 “Apple Music, 운동용 재생목록 만들어줘”와 같은 프롬프트로 대화를 시작하여 재생목록을 생성할 수 있게 한다.• 수정된 발표는 시기상조의 공개를 시사하며, OpenAI의 확장되는 앱 생태계의 일부로 음악 스트리밍 기능이 언제 출시될지에 대한 공식 일정은 제공되지 않았다.
572 조회
0 추천
2025.12.17 등록
• Google의 Gemini [GOOG -0.51%] AI 어시스턴트는 이번 주에 새로운 자동 화면 컨텍스트 기능의 출시를 시작했으며, 이 기능은 사용자가 관련 질문을 할 때 화면의 콘텐츠를 자동으로 캡처하고 분석하여 “화면에 대해 물어보기” 버튼을 수동으로 탭할 필요를 없애줍니다• 이 기능은 언어 단서를 사용하여 “이 오류는 무엇을 의미하나요?” 또는 “이 글을 요약해 주세요”와 같은 화면 관련 프롬프트를 감지하며, 앱, 이미지 및 동영상 전반에서 작동합니다. 다만 초기 테스트 결과 이러한 쿼리를 약 50%의 정확도로 식별하는 것으로 나타났습니다.• 사용자는 Gemini 설정을 통해 자동 스크린샷 기능을 비활성화할 수 있으며, Android의 FLAG_SECURE 보호 기능은 뱅킹 앱, 스트리밍 서비스 및 비공개 브라우징 모드가 캡처에서 제외되도록 보장합니다.
545 조회
0 추천
2025.12.17 등록
• Google [GOOG -0.51%]은 12월 16일 Opal 워크플로우 빌더를 Gemini 웹 앱에 통합하여, 사용자들이 Super Gems라는 새로운 기능을 통해 코딩 없이 AI 기반 미니 애플리케이션을 만들 수 있도록 했습니다.• 이 통합은 Opal을 Gemini의 Gems Manager에 통합하며, 자연어 설명을 자동 생성된 단계와 인터페이스 요소가 포함된 시각적 워크플로우로 변환하는 Workflow Builder를 제공하고, 이는 공유 가능한 링크를 통해 게시될 수 있습니다.• 현재 출시는 미국 사용자로 제한되어 있으며, 이는 Google이 Gemini를 맞춤형 AI 도구 구축을 위한 중앙 플랫폼으로 포지셔닝하면서 다른 Labs 통합과 동일한 단계적 접근 방식을 따르고 있습니다.
601 조회
0 추천
2025.12.17 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입