AI 뉴스

AI 에이전트, 기업들이 약속하고 절실히 필요로 하는 미래

페이지 정보

작성자 symbolika
작성일 2025.12.31 00:47
305 조회
0 추천
0 비추천

본문

AI Agents

• AI 기업들이 '에이전트'라 불리는 자율 AI 시스템 개발에 총력을 기울이고 있으며, 이는 수익화를 위한 핵심 전략으로 부상했다

• 마이크로소프트, 구글, 앤스로픽, 오픈AI 등 주요 기업들이 고객 서비스부터 예약까지 다양한 업무를 자동화하는 AI 에이전트를 선보이고 있다

• AI 에이전트 스타트업에 지난 12개월간 82억 달러의 투자가 유입되며 전년 대비 81.4% 증가했다

• 그러나 현재 기술 수준에서 AI 에이전트는 다단계 작업이나 예상치 못한 상황에서 오류가 발생하며, AI 환각 문제 등 신뢰성 우려가 있다

• 오픈AI는 2025년을 AI 에이전트가 본격적으로 주류에 진입하는 해가 될 것으로 전망하고 있다


인류는 수세기 동안 작업을 자동화해왔다. 이제 AI 기업들은 효율성에 대한 우리의 열망을 수익으로 연결할 방안을 찾았고, 그 해법에 '에이전트'라는 이름을 붙였다.


AI 에이전트는 사람의 개입을 최소화하면서 업무를 수행하고, 의사결정을 내리며, 환경과 상호작용하는 자율 프로그램이다. 오늘날 AI 분야에서 활동하는 모든 주요 기업이 이에 주목하고 있다. 마이크로소프트는 고객 서비스와 관리 업무 자동화를 돕는 '코파일럿'을 개발했다. 구글 클라우드의 토마스 쿠리안 CEO는 최근 6가지 AI 생산성 에이전트 구상을 발표했고, 구글 딥마인드는 AI 비디오 제품 '소라'의 공동 책임자를 오픈AI에서 영입해 AI 에이전트 훈련용 시뮬레이션 개발에 투입했다. 앤스로픽은 자사 AI 챗봇 '클로드'에 누구나 자신만의 'AI 어시스턴트'를 만들 수 있는 기능을 추가했다. 오픈AI는 범용인공지능(AGI), 즉 인간 수준의 인공지능에 도달하기 위한 5단계 접근법에서 에이전트를 2단계로 설정했다.


물론 컴퓨팅 분야에는 자율 시스템이 이미 넘쳐난다. 팝업 고객 서비스 봇이 있는 웹사이트를 방문하거나, 알렉사 스킬 같은 자동 음성 비서 기능을 사용하거나, 간단한 IFTTT 스크립트를 작성해본 사람도 많다. 그러나 AI 기업들은 '에이전트'가—이들은 절대 '봇'이라 부르지 말라고 한다—다르다고 주장한다. 단순하고 반복적인 명령을 따르는 대신, 에이전트는 환경과 상호작용하고, 피드백에서 학습하며, 지속적인 인간의 개입 없이 의사결정을 내릴 수 있다고 믿는다. 이들은 구매, 여행 예약, 회의 일정 조율 같은 업무를 동적으로 관리하면서 예상치 못한 상황에 적응하고, 인간과 다른 AI 도구를 포함한 시스템과 상호작용할 수 있다.


AI 기업들은 에이전트가 강력하지만 비용이 많이 드는 AI 모델을 수익화할 방법이 되기를 바란다. 벤처 캐피털이 기술과의 상호작용 방식을 혁신하겠다고 약속하는 AI 에이전트 스타트업에 쏟아지고 있다. 기업들은 고객 서비스부터 데이터 분석까지 모든 것을 에이전트가 처리하는 효율성의 도약을 꿈꾼다. 개인 사용자에게 AI 기업들은 일상적인 업무가 자동화되어 창의적이고 전략적인 일에 시간을 확보할 수 있는 새로운 생산성의 시대를 제시하고 있다. 진정한 신봉자들의 최종 목표는 단순한 도구가 아닌 진정한 파트너가 되는 AI를 만드는 것이다.


오픈AI CEO 샘 알트만은 올해 초 MIT 테크놀로지 리뷰와의 인터뷰에서 사용자들이 진정으로 원하는 것은 "그냥 곁에서 도와주는 존재"라고 말했다. 그는 킬러 AI 앱이 간단한 작업은 즉시 처리하고, 복잡한 것은 가서 답을 찾아 돌아올 수 있어야 한다고 했다. "내 모든 이메일, 모든 대화 등 내 삶 전체를 완벽히 알고 있지만, 그러면서도 내 연장처럼 느껴지지 않는 초유능 동료"와 같은 존재가 될 것이라고 했다. 기술 기업들은 적어도 1970년대부터 개인 비서를 자동화하려 해왔으며, 이제 드디어 가까워지고 있다고 약속한다.


오픈AI가 연례 Dev Day를 앞두고 열린 언론 행사에서 개발자 경험 담당 로맹 위에는 회사의 새로운 실시간 API를 활용한 어시스턴트 에이전트를 시연했다. 위에는 에이전트에게 예산과 몇 가지 조건을 주고 초콜릿 딸기 400개를 주문하도록 했으며, 가상의 상점에 전화를 걸어 주문하도록 지시했다.


이 서비스는 2018년 구글이 선보인 예약 봇 '듀플렉스'와 유사하다. 하지만 그 봇은 가장 단순한 시나리오만 처리할 수 있었고, 통화의 4분의 1은 실제로 사람이 처리하는 것으로 드러났다.


영어로 주문이 이루어졌지만, 위에는 도쿄에서 더 복잡한 시연을 했다고 전했다. 그는 에이전트에게 일본어로 호텔 객실을 예약하도록 지시했고, 에이전트는 일본어로 대화를 처리한 뒤 영어로 다시 전화해 완료를 확인했다. "물론 저는 일본어 부분을 이해하지 못했습니다—에이전트가 알아서 처리했죠"라고 위에는 말했다.


그러나 위에의 시연은 기자들로 가득 찬 현장에서 즉각적인 우려를 불러일으켰다. AI 어시스턴트가 스팸 전화에 악용될 수 있지 않을까? 왜 스스로를 AI 시스템이라고 밝히지 않았을까? (위에는 공식 Dev Day에서 시연을 업데이트해 에이전트가 스스로를 "로맹의 AI 어시스턴트"라고 소개하도록 했다고 참석자가 전했다.) 불안감이 감지됐고, 이는 놀라운 일이 아니었다—에이전트가 없어도 AI 도구는 이미 기만에 사용되고 있다.


더 즉각적인 문제도 있었다: 시연이 제대로 작동하지 않았다. 에이전트는 충분한 정보가 없었고 디저트 맛을 잘못 기록해 바닐라와 딸기 같은 맛을 열에 자동 입력했다. 해당 정보가 없다고 말하는 대신 말이다. 에이전트는 다단계 워크플로우나 예상치 못한 시나리오에서 자주 문제를 일으킨다. 또한 기존 봇이나 음성 비서보다 더 많은 에너지를 소모한다. 추론하거나 여러 시스템과 상호작용할 때 상당한 컴퓨팅 파워가 필요해 대규모 운영 비용이 높다.


AI 에이전트는 잠재력 면에서 도약을 제공하지만, 일상적인 업무에서 봇, 어시스턴트, 스크립트보다 아직 크게 나은 것은 아니다. 오픈AI와 다른 연구소들은 강화학습을 통해 추론 능력을 향상시키면서 무어의 법칙이 계속해서 더 저렴하고 강력한 컴퓨팅을 제공하기를 바라고 있다.


그렇다면 AI 에이전트가 아직 그다지 유용하지 않은데 왜 이 아이디어가 이토록 인기가 있을까? 간단히 말해: 시장 압력이다. 이들 기업은 강력하지만 비싼 기술을 보유하고 있으며 사용자에게 비용을 청구할 수 있는 실용적인 사용 사례를 찾기에 급급하다. 약속과 현실 사이의 격차는 또한 투자를 촉진하는 매력적인 과대 광고 사이클을 만들어내고, 공교롭게도 오픈AI는 에이전트를 띄우기 시작하면서 66억 달러를 조달했다.


AI 에이전트 스타트업들은 지난 12개월 동안 투자자로부터 82억 달러를 확보했다.


대형 기술 기업들은 온갖 종류의 'AI'를 자사 제품에 통합하기 위해 분주하지만, 특히 AI 어시스턴트가 수익을 창출하는 열쇠가 될 수 있기를 기대한다. 위에의 AI 통화 시연은 현재 모델이 대규모로 수행할 수 있는 수준을 앞서지만, 그는 오픈AI가 '추론' o1 모델을 개선하면서 내년에는 이런 기능이 더 일반화될 것으로 예상한다고 말했다.


현재 이 개념은 주로 소비자용 제품이 아닌 기업용 소프트웨어 스택에 국한된 것으로 보인다. 고객 관계 관리(CRM) 소프트웨어를 제공하는 세일즈포스는 연례 드림포스 컨퍼런스를 몇 주 앞두고 '에이전트' 기능을 대대적으로 선보였다. 이 기능은 고객이 자연어를 사용해 슬랙을 통해 몇 분 만에 고객 서비스 챗봇을 구축할 수 있게 해준다. 코딩에 많은 시간을 들이는 대신 말이다. 이 챗봇은 회사의 CRM 데이터에 접근할 수 있고 대규모 언어 모델 기반이 아닌 봇보다 자연어를 더 쉽게 처리할 수 있어 주문과 반품에 대한 질문 처리 같은 제한된 업무에서 더 나은 성능을 보일 가능성이 있다.


AI 에이전트 스타트업(여전히 다소 모호한 용어다)은 이미 상당히 뜨거운 투자처가 되고 있다. 피치북 데이터에 따르면, 지난 12개월 동안 156건의 거래에 걸쳐 82억 달러의 투자자 자금을 확보했으며, 이는 전년 대비 81.4% 증가한 수치다. 더 잘 알려진 프로젝트 중 하나는 세일즈포스 전 공동 CEO 브렛 테일러가 창업한, 세일즈포스의 최근 프로젝트와 유사한 고객 서비스 에이전트 시에라다. 변호사를 위한 AI 에이전트 하비, 세금 처리용 AI 에이전트 택스GPT도 있다.


에이전트에 대한 모든 열광에도 불구하고, 이러한 고위험 사용 사례는 분명한 질문을 제기한다: 법률이나 세금처럼 심각한 문제를 에이전트에게 맡겨도 정말 믿을 수 있을까? ChatGPT 사용자들을 자주 곤경에 빠뜨린 AI 환각은 현재 해결책이 보이지 않는다. 더 근본적으로 IBM이 1979년에 선견지명 있게 밝혔듯이 "컴퓨터는 결코 책임을 질 수 없다"—그리고 그 귀결로 "컴퓨터는 절대 경영 결정을 내려서는 안 된다." 자율적인 의사결정자라기보다 AI 어시스턴트는 있는 그대로 봐야 한다: 저위험 업무를 위한 강력하지만 불완전한 도구. 이것이 AI 기업들이 사람들에게 청구하려는 거금의 가치가 있을까?


현재로서는 시장 압력이 우세하며, AI 기업들은 수익화 경쟁을 벌이고 있다. 오픈AI의 신임 최고 제품 책임자 케빈 웨일은 언론 행사에서 "2025년이 에이전트 시스템이 마침내 주류에 진입하는 해가 될 것으로 본다"고 말했다. "제대로 하면, 정말 중요한 인간적인 일에 더 많은 시간을 쓰고, 휴대폰만 들여다보는 시간을 조금 줄일 수 있는 세상으로 우리를 데려다줄 것입니다."

댓글 0
전체 1,366 / 5 페이지
Executive Summary • 중국 AI 스타트업 딥시크(DeepSeek)가 수 주 내로 차세대 플래그십 모델 V4를 출시할 예정 • 내부 벤치마크에서 앤트로픽 클로드와 OpenAI ChatGPT를 코딩 능력에서 능가하는 것으로 나타남 • 특히 매우 긴 코딩 프롬프트 처리에서 획기적인 성능 개선을 달성 Background 딥시크는 2025년 1월 R1 추론 모델을 출시하며 글로벌 AI 업계에 큰 파장을 일으킨 바 있다. 당시 저비용으로 고성능을 구현해 미국 빅테크 기업들의 AI 투자 전략에 의문을 제기하게 만들었으며, 이번 V4 모델 출시로 다시 한번 시장에 충격을 줄 것으로 예상된다. Impact & Implications 기술적 의미 딥시크 V4는 "극도로 긴 코딩 프롬프트 처리"에서 획기적인 발전을 이루었다고 알려졌다. 이는 복잡한 대규모 코드베이스를 다루는 개발자들에게 실질적인 도움이 될 수 있음을 시사한다. 현재 클로드와 ChatGPT가 코딩 분야에서 선두를 달리고 있는 상황에서, 딥시크가 이 두 모델을 벤치마크에서 앞섰다는 주장은 상당히 주목할 만하다. 경쟁 구도 변화 딥시크가 코딩 AI 영역에서 앤트로픽과 OpenAI를 능가할 경우, AI 개발 도구 시장의 판도가 크게 바뀔 수 있다. 특히 GitHub Copilot, Cursor 등 AI 코딩 어시스턴트 서비스들이 어떤 모델을 기반으로 삼을지에 영향을 미칠 수 있다. 향후 전망 V4는 R1 출시 약 1년 만인 수 주 내 공개될 예정이다. 딥시크가 공개한 내부 벤치마크 결과가 독립적인 테스트에서도 입증될지, 그리고 실제 개발 현장에서 어떤 평가를 받을지 주목된다. Key Data & Facts 항목수치/내용 모델명DeepSeek V4 출시 예정수 주 내 핵심 강점장문 코딩 프롬프트 처리 비교 대상Claude, ChatGPT 전작R1 (2025년 1월 출시) Key Quote "DeepSeek's internal benchmarks put it ahead of Anthropic and OpenAI's models in coding." — The Information
290 조회
0 추천
01.10 등록
Executive Summary • 오픈AI가 개인 의료 기록과 건강 앱을 연동할 수 있는 'ChatGPT 헬스' 탭을 공식 출시 • 애플 헬스, 마이피트니스팔, 웨이트와처스 등 주요 건강 앱과 통합 지원 • 전 세계 2억 3천만 명이 매주 ChatGPT에 건강 관련 질문을 하고 있다고 밝혀 • 단, 진단이나 치료 목적이 아님을 명시하며 개인정보 보호에 대한 우려도 제기 Background 오픈AI는 최근 AI가 '헬스케어 동반자' 역할을 할 수 있다는 암시를 지속적으로 내비쳐왔다. 이번 ChatGPT 헬스 출시는 이러한 전략의 연장선상에 있으며, 이미 매주 2억 3천만 명 이상이 ChatGPT에 건강 관련 질문을 하고 있다는 자체 분석 결과를 근거로 내세웠다. 특히 의료 서비스 접근이 어려운 농촌 지역에서는 주당 약 60만 건의 건강 관련 메시지가 전송되고, 헬스케어 대화의 70%가 일반 진료 시간 외에 이루어지고 있다고 한다. Impact & Implications 산업/시장 영향 ChatGPT 헬스는 AI 기업들의 헬스케어 시장 진출 경쟁을 한층 가속화할 전망이다. 오픈AI는 b.well과의 파트너십을 통해 약 220만 명의 의료 제공자와 연결되는 백엔드 통합을 구현했다. 현재는 베타 사용자를 대상으로 대기자 명단 방식으로 운영되지만, 향후 구독 티어에 관계없이 전체 사용자에게 점진적으로 확대될 예정이다. 이는 구글, 마이크로소프트 등 경쟁사들도 유사한 서비스 개발에 박차를 가할 수 있음을 의미한다. 규제/정책 영향 흥미롭게도 오픈AI 측은 소비자 제품의 경우 HIPAA(미국 의료정보보호법)가 적용되지 않는다고 밝혔다. 이는 임상 또는 전문 의료 환경에만 해당된다는 설명이다. 그러나 법원 명령이 있을 경우 데이터 접근을 제공해야 하며, 과거 2023년 3월에 일부 사용자의 채팅 제목, 이름, 이메일, 결제 정보가 노출된 보안 사고가 있었던 점을 고려하면 규제 당국의 감시가 강화될 가능성이 높다. 사용자 영향 사용자는 검사 결과 분석, 진료 예약 준비, 식단 및 운동 조언, 보험 옵션 비교 등에 ChatGPT 헬스를 활용할 수 있다. 그러나 정신 건강 관련 상담에 대해서는 오픈AI가 신중한 태도를 보이고 있으며, ChatGPT 이용 후 자살로 이어진 사례들이 보고된 바 있어 우려가 제기된다. 또한 건강 불안 장애(히포콘드리아) 환자의 증상 악화 가능성에 대한 질문에 오픈AI는 "정보 제공은 하되 경보를 울리지 않도록 모델을 조정했다"고 답변했다. Key Data & Facts 항목수치/내용 주간 건강 질문 사용자2억 3천만 명 협력 의사 수260명 이상 모델 피드백 횟수60만 회 이상 연결 의료 제공자약 220만 명 (b.well 파트너십) 농촌 지역 주간 메시지약 60만 건 Key Quote "ChatGPT can help you understand recent test results, prepare for appointments with your doctor, get advice on how to approach your diet and workout routine, or understand the tradeoffs of different insurance options based on your healthcare patterns." — 오픈AI 블로그
279 조회
0 추천
01.09 등록
Executive Summary • xAI의 챗봇 Grok이 X 플랫폼에서 여성 사진을 비키니 착용 이미지로 변환하는 기능으로 대규모 비동의 성적 이미지 생성에 악용되고 있음 • 분석 결과 2시간 동안 15,000개 이상의 Grok 생성 이미지 URL이 수집되었으며, 5분당 최소 90개의 성적 이미지가 생성되는 것으로 확인 • 영국, 호주, 프랑스 등 각국 정부가 X에 긴급 조치를 요구하며 AI 딥페이크 규제 논의 가속화 Background AI 기반 '누드화(nudify)' 기술은 그동안 인터넷 음지에서 유료로 제공되어 왔으나, 이번 Grok 사태는 주류 소셜미디어 플랫폼에서 무료로, 누구나 쉽게 접근 가능한 형태로 확산되었다는 점에서 전례 없는 규모의 문제로 부상했다. 지난해 말부터 Grok의 이미지 생성 기능이 바이럴되면서 인플루언서, 유명인, 심지어 정치인까지 타깃이 되고 있다. Impact & Implications AI 안전 및 윤리 측면 Grok은 기존 유료 딥페이크 서비스와 달리 무료이며 수초 내 결과물을 생성하고, 수백만 X 사용자가 즉시 접근할 수 있어 비동의 성적 이미지 생성의 대중화를 가속하고 있다. EndTAB의 슬론 톰슨 이사는 "X가 AI 기반 이미지 악용을 주류 플랫폼에 직접 내장해 성폭력을 더 쉽고 확장 가능하게 만들었다"고 지적했다. 규제 및 정책 동향 영국 정부는 X에 긴급 조치를 공식 요청했으며, 리즈 켄달 기술부 장관은 "최근 온라인에서 목격한 것들은 절대적으로 끔찍하며, 문명사회에서 용납될 수 없다"고 강조했다. 호주 eSafety 위원회도 Grok 관련 다수의 신고를 접수해 조사 중이며, 프랑스, 인도, 말레이시아 등도 조사 위협을 시사했다. 산업 전반 영향 미 의회는 지난해 TAKE IT DOWN Act를 통과시켜 비동의 성적 이미지 공개를 불법화했으며, 5월 중순부터 X를 포함한 온라인 플랫폼들은 48시간 내 신고 대응 의무를 지게 된다. 이번 사태는 생성형 AI 플랫폼의 안전 가드레일 설계와 책임 소재에 대한 업계 전반의 논의를 촉발할 전망이다. Key Data & Facts 항목수치/내용 2시간 내 수집된 Grok 생성 이미지 URL15,000개 이상 5분간 생성된 성적 이미지 수최소 90개 2023-2024 AI 관련 아동학대 신고 증가율 (NCMEC)1,325% TAKE IT DOWN Act 플랫폼 대응 의무 기한48시간 연간 누드화 서비스 추정 수익3,600만 달러 이상 Key Quote "기업이 플랫폼에서 생성형 AI 도구를 제공할 때, 이미지 기반 악용의 위험을 최소화할 책임이 있다. 여기서 놀라운 점은 X가 정반대로 행동했다는 것이다. 그들은 AI 기반 이미지 악용을 주류 플랫폼에 직접 내장해 성폭력을 더 쉽고 확장 가능하게 만들었다." — 슬론 톰슨, EndTAB 교육훈련 이사
286 조회
0 추천
01.08 등록
Executive Summary • xAI의 Grok 챗봇이 X 플랫폼에서 생성되는 것보다 훨씬 노골적인 성적 이미지와 영상을 생성하고 있음이 밝혀졌다 • 비영리단체 AI Forensics가 검토한 약 800개의 Grok Imagine URL 중 대다수가 성적 콘텐츠였으며, 10% 미만이 아동 성 학대 자료(CSAM)와 관련된 것으로 추정된다 • OpenAI, Google 등 타 AI 기업과 달리 xAI는 Grok의 성인 콘텐츠 생성을 허용하고 있으며, '스파이시(spicy)' 모드를 통해 포르노그래피 제작이 가능하다 • 유럽 규제당국에 약 70건의 URL이 신고되었으며, 프랑스 검찰은 관련 조사에 착수했다 • 영국 더럼대학의 법학 교수는 이를 "가드레일이나 윤리 지침 없이 인간의 타락한 충동을 조장하는 기술"이라고 비판했다 Background xAI의 Grok 챗봇이 X(구 트위터) 플랫폼에서 여성과 미성년자로 보이는 대상의 '옷 벗기기' 이미지를 대량 생성해 논란이 된 지 일주일여 만에, 별도 앱과 웹사이트에서는 훨씬 더 심각한 수준의 성적 콘텐츠가 생성되고 있는 것으로 드러났다. X에서는 공개가 기본 설정이지만, Grok 앱과 웹사이트의 Imagine 모델로 생성된 콘텐츠는 비공개로 처리되어 감시의 사각지대에 놓여 있었다. Impact & Implications AI 안전성과 규제 강화 압력 이번 사태는 생성형 AI의 유해 콘텐츠 생성 문제에 대한 규제 논의를 가속화할 전망이다. OpenAI와 Google이 명시적으로 포르노그래피 생성을 금지하는 것과 달리, xAI는 '스파이시' 모드를 통해 성인 콘텐츠를 허용하는 차별화된 정책을 취하고 있다. 프랑스 검찰의 조사 착수와 유럽 규제당국에 대한 신고는 각국이 AI 생성 CSAM에 대해 강력한 법적 조치를 취할 수 있음을 시사한다. 플랫폼 책임과 콘텐츠 모더레이션 Grok은 X와 달리 성적으로 노골적인 콘텐츠 시청에 대한 연령 확인 절차가 없는 것으로 나타났다. 미국 여러 주에서 성인 콘텐츠 비율이 일정 수준 이상인 웹사이트에 대해 연령 인증법을 시행하고 있어, xAI가 법적 리스크에 직면할 수 있다. 딥페이크 포르노 포럼에서는 Grok의 콘텐츠 필터를 우회하는 프롬프트 기법이 활발히 공유되고 있어, 기술적 대응만으로는 한계가 있음을 보여준다. AI 업계 신뢰도에 미치는 영향 머스크가 X에서 "불법 콘텐츠를 만드는 사람은 불법 콘텐츠를 업로드하는 것과 같은 결과를 받게 될 것"이라고 밝혔음에도 불구하고, 포럼 사용자들은 여전히 노골적인 콘텐츠 생성에 성공하고 있다고 보고하고 있다. 이는 AI 기업들의 안전 정책 이행에 대한 신뢰도 문제를 제기하며, 전체 AI 산업에 대한 규제 강화로 이어질 수 있다. Key Data & Facts 항목수치/내용 분석된 Grok Imagine URL 수약 1,200개 성적 콘텐츠 포함 URL약 800개 CSAM 관련 추정 비율10% 미만 규제당국 신고 건수약 70개 URL 딥페이크 포럼 토론 페이지300페이지 이상 Key Quote "윤리 지침이나 가드레일 없이 기술이 일부 사람들의 비인간적 충동을 조장하고 촉진하고 있다. 지난 몇 주간의 사태와 이번 일로, 우리는 절벽에서 떨어져 인간 타락의 심연으로 자유낙하하고 있는 것 같다." — 클레어 맥글린(Clare McGlynn), 더럼대학교 법학 교수
284 조회
0 추천
01.08 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입