AI 뉴스

AI 에이전트, 기업들이 약속하고 절실히 필요로 하는 미래

페이지 정보

작성자 symbolika
작성일 2025.12.31 00:47
326 조회
0 추천
0 비추천

본문

AI Agents

• AI 기업들이 '에이전트'라 불리는 자율 AI 시스템 개발에 총력을 기울이고 있으며, 이는 수익화를 위한 핵심 전략으로 부상했다

• 마이크로소프트, 구글, 앤스로픽, 오픈AI 등 주요 기업들이 고객 서비스부터 예약까지 다양한 업무를 자동화하는 AI 에이전트를 선보이고 있다

• AI 에이전트 스타트업에 지난 12개월간 82억 달러의 투자가 유입되며 전년 대비 81.4% 증가했다

• 그러나 현재 기술 수준에서 AI 에이전트는 다단계 작업이나 예상치 못한 상황에서 오류가 발생하며, AI 환각 문제 등 신뢰성 우려가 있다

• 오픈AI는 2025년을 AI 에이전트가 본격적으로 주류에 진입하는 해가 될 것으로 전망하고 있다


인류는 수세기 동안 작업을 자동화해왔다. 이제 AI 기업들은 효율성에 대한 우리의 열망을 수익으로 연결할 방안을 찾았고, 그 해법에 '에이전트'라는 이름을 붙였다.


AI 에이전트는 사람의 개입을 최소화하면서 업무를 수행하고, 의사결정을 내리며, 환경과 상호작용하는 자율 프로그램이다. 오늘날 AI 분야에서 활동하는 모든 주요 기업이 이에 주목하고 있다. 마이크로소프트는 고객 서비스와 관리 업무 자동화를 돕는 '코파일럿'을 개발했다. 구글 클라우드의 토마스 쿠리안 CEO는 최근 6가지 AI 생산성 에이전트 구상을 발표했고, 구글 딥마인드는 AI 비디오 제품 '소라'의 공동 책임자를 오픈AI에서 영입해 AI 에이전트 훈련용 시뮬레이션 개발에 투입했다. 앤스로픽은 자사 AI 챗봇 '클로드'에 누구나 자신만의 'AI 어시스턴트'를 만들 수 있는 기능을 추가했다. 오픈AI는 범용인공지능(AGI), 즉 인간 수준의 인공지능에 도달하기 위한 5단계 접근법에서 에이전트를 2단계로 설정했다.


물론 컴퓨팅 분야에는 자율 시스템이 이미 넘쳐난다. 팝업 고객 서비스 봇이 있는 웹사이트를 방문하거나, 알렉사 스킬 같은 자동 음성 비서 기능을 사용하거나, 간단한 IFTTT 스크립트를 작성해본 사람도 많다. 그러나 AI 기업들은 '에이전트'가—이들은 절대 '봇'이라 부르지 말라고 한다—다르다고 주장한다. 단순하고 반복적인 명령을 따르는 대신, 에이전트는 환경과 상호작용하고, 피드백에서 학습하며, 지속적인 인간의 개입 없이 의사결정을 내릴 수 있다고 믿는다. 이들은 구매, 여행 예약, 회의 일정 조율 같은 업무를 동적으로 관리하면서 예상치 못한 상황에 적응하고, 인간과 다른 AI 도구를 포함한 시스템과 상호작용할 수 있다.


AI 기업들은 에이전트가 강력하지만 비용이 많이 드는 AI 모델을 수익화할 방법이 되기를 바란다. 벤처 캐피털이 기술과의 상호작용 방식을 혁신하겠다고 약속하는 AI 에이전트 스타트업에 쏟아지고 있다. 기업들은 고객 서비스부터 데이터 분석까지 모든 것을 에이전트가 처리하는 효율성의 도약을 꿈꾼다. 개인 사용자에게 AI 기업들은 일상적인 업무가 자동화되어 창의적이고 전략적인 일에 시간을 확보할 수 있는 새로운 생산성의 시대를 제시하고 있다. 진정한 신봉자들의 최종 목표는 단순한 도구가 아닌 진정한 파트너가 되는 AI를 만드는 것이다.


오픈AI CEO 샘 알트만은 올해 초 MIT 테크놀로지 리뷰와의 인터뷰에서 사용자들이 진정으로 원하는 것은 "그냥 곁에서 도와주는 존재"라고 말했다. 그는 킬러 AI 앱이 간단한 작업은 즉시 처리하고, 복잡한 것은 가서 답을 찾아 돌아올 수 있어야 한다고 했다. "내 모든 이메일, 모든 대화 등 내 삶 전체를 완벽히 알고 있지만, 그러면서도 내 연장처럼 느껴지지 않는 초유능 동료"와 같은 존재가 될 것이라고 했다. 기술 기업들은 적어도 1970년대부터 개인 비서를 자동화하려 해왔으며, 이제 드디어 가까워지고 있다고 약속한다.


오픈AI가 연례 Dev Day를 앞두고 열린 언론 행사에서 개발자 경험 담당 로맹 위에는 회사의 새로운 실시간 API를 활용한 어시스턴트 에이전트를 시연했다. 위에는 에이전트에게 예산과 몇 가지 조건을 주고 초콜릿 딸기 400개를 주문하도록 했으며, 가상의 상점에 전화를 걸어 주문하도록 지시했다.


이 서비스는 2018년 구글이 선보인 예약 봇 '듀플렉스'와 유사하다. 하지만 그 봇은 가장 단순한 시나리오만 처리할 수 있었고, 통화의 4분의 1은 실제로 사람이 처리하는 것으로 드러났다.


영어로 주문이 이루어졌지만, 위에는 도쿄에서 더 복잡한 시연을 했다고 전했다. 그는 에이전트에게 일본어로 호텔 객실을 예약하도록 지시했고, 에이전트는 일본어로 대화를 처리한 뒤 영어로 다시 전화해 완료를 확인했다. "물론 저는 일본어 부분을 이해하지 못했습니다—에이전트가 알아서 처리했죠"라고 위에는 말했다.


그러나 위에의 시연은 기자들로 가득 찬 현장에서 즉각적인 우려를 불러일으켰다. AI 어시스턴트가 스팸 전화에 악용될 수 있지 않을까? 왜 스스로를 AI 시스템이라고 밝히지 않았을까? (위에는 공식 Dev Day에서 시연을 업데이트해 에이전트가 스스로를 "로맹의 AI 어시스턴트"라고 소개하도록 했다고 참석자가 전했다.) 불안감이 감지됐고, 이는 놀라운 일이 아니었다—에이전트가 없어도 AI 도구는 이미 기만에 사용되고 있다.


더 즉각적인 문제도 있었다: 시연이 제대로 작동하지 않았다. 에이전트는 충분한 정보가 없었고 디저트 맛을 잘못 기록해 바닐라와 딸기 같은 맛을 열에 자동 입력했다. 해당 정보가 없다고 말하는 대신 말이다. 에이전트는 다단계 워크플로우나 예상치 못한 시나리오에서 자주 문제를 일으킨다. 또한 기존 봇이나 음성 비서보다 더 많은 에너지를 소모한다. 추론하거나 여러 시스템과 상호작용할 때 상당한 컴퓨팅 파워가 필요해 대규모 운영 비용이 높다.


AI 에이전트는 잠재력 면에서 도약을 제공하지만, 일상적인 업무에서 봇, 어시스턴트, 스크립트보다 아직 크게 나은 것은 아니다. 오픈AI와 다른 연구소들은 강화학습을 통해 추론 능력을 향상시키면서 무어의 법칙이 계속해서 더 저렴하고 강력한 컴퓨팅을 제공하기를 바라고 있다.


그렇다면 AI 에이전트가 아직 그다지 유용하지 않은데 왜 이 아이디어가 이토록 인기가 있을까? 간단히 말해: 시장 압력이다. 이들 기업은 강력하지만 비싼 기술을 보유하고 있으며 사용자에게 비용을 청구할 수 있는 실용적인 사용 사례를 찾기에 급급하다. 약속과 현실 사이의 격차는 또한 투자를 촉진하는 매력적인 과대 광고 사이클을 만들어내고, 공교롭게도 오픈AI는 에이전트를 띄우기 시작하면서 66억 달러를 조달했다.


AI 에이전트 스타트업들은 지난 12개월 동안 투자자로부터 82억 달러를 확보했다.


대형 기술 기업들은 온갖 종류의 'AI'를 자사 제품에 통합하기 위해 분주하지만, 특히 AI 어시스턴트가 수익을 창출하는 열쇠가 될 수 있기를 기대한다. 위에의 AI 통화 시연은 현재 모델이 대규모로 수행할 수 있는 수준을 앞서지만, 그는 오픈AI가 '추론' o1 모델을 개선하면서 내년에는 이런 기능이 더 일반화될 것으로 예상한다고 말했다.


현재 이 개념은 주로 소비자용 제품이 아닌 기업용 소프트웨어 스택에 국한된 것으로 보인다. 고객 관계 관리(CRM) 소프트웨어를 제공하는 세일즈포스는 연례 드림포스 컨퍼런스를 몇 주 앞두고 '에이전트' 기능을 대대적으로 선보였다. 이 기능은 고객이 자연어를 사용해 슬랙을 통해 몇 분 만에 고객 서비스 챗봇을 구축할 수 있게 해준다. 코딩에 많은 시간을 들이는 대신 말이다. 이 챗봇은 회사의 CRM 데이터에 접근할 수 있고 대규모 언어 모델 기반이 아닌 봇보다 자연어를 더 쉽게 처리할 수 있어 주문과 반품에 대한 질문 처리 같은 제한된 업무에서 더 나은 성능을 보일 가능성이 있다.


AI 에이전트 스타트업(여전히 다소 모호한 용어다)은 이미 상당히 뜨거운 투자처가 되고 있다. 피치북 데이터에 따르면, 지난 12개월 동안 156건의 거래에 걸쳐 82억 달러의 투자자 자금을 확보했으며, 이는 전년 대비 81.4% 증가한 수치다. 더 잘 알려진 프로젝트 중 하나는 세일즈포스 전 공동 CEO 브렛 테일러가 창업한, 세일즈포스의 최근 프로젝트와 유사한 고객 서비스 에이전트 시에라다. 변호사를 위한 AI 에이전트 하비, 세금 처리용 AI 에이전트 택스GPT도 있다.


에이전트에 대한 모든 열광에도 불구하고, 이러한 고위험 사용 사례는 분명한 질문을 제기한다: 법률이나 세금처럼 심각한 문제를 에이전트에게 맡겨도 정말 믿을 수 있을까? ChatGPT 사용자들을 자주 곤경에 빠뜨린 AI 환각은 현재 해결책이 보이지 않는다. 더 근본적으로 IBM이 1979년에 선견지명 있게 밝혔듯이 "컴퓨터는 결코 책임을 질 수 없다"—그리고 그 귀결로 "컴퓨터는 절대 경영 결정을 내려서는 안 된다." 자율적인 의사결정자라기보다 AI 어시스턴트는 있는 그대로 봐야 한다: 저위험 업무를 위한 강력하지만 불완전한 도구. 이것이 AI 기업들이 사람들에게 청구하려는 거금의 가치가 있을까?


현재로서는 시장 압력이 우세하며, AI 기업들은 수익화 경쟁을 벌이고 있다. 오픈AI의 신임 최고 제품 책임자 케빈 웨일은 언론 행사에서 "2025년이 에이전트 시스템이 마침내 주류에 진입하는 해가 될 것으로 본다"고 말했다. "제대로 하면, 정말 중요한 인간적인 일에 더 많은 시간을 쓰고, 휴대폰만 들여다보는 시간을 조금 줄일 수 있는 세상으로 우리를 데려다줄 것입니다."

댓글 0
전체 1,366 / 28 페이지
600만 명의 사용자를 보유하고 “추천(Featured)” 배지를 단 Google Chrome 확장 프로그램인 Urban VPN Proxy가, 2025년 7월부터 사용자의 ChatGPT, Gemini, Claude 및 기타 7개 AI 플랫폼과의 비공개 대화를 몰래 가로채 데이터 브로커에게 판매해 온 것으로 Koi Security 소속 보안 연구원들의 분석 결과 드러났다.이 확장 프로그램은 AI 플랫폼 페이지에 전용 스크립트를 주입하여 브라우저 기능을 재정의하고, 모든 프롬프트와 응답, 대화 시간 정보, 세션 메타데이터(의료 관련 질문, 금융 정보, 독점 소스 코드 등 포함)를 포착한 뒤 이를 Urban VPN의 서버로 전송해 “마케팅 분석 목적”으로 활용한다.동일한 수집 코드를 포함한 동일 발행인의 추가 확장 프로그램 7개가 Chrome과 Microsoft Edge에서 총 800만 명이 넘는 사용자에게 영향을 주고 있으며, 이 데이터 수집 기능은 하드코딩된 설정으로 기본 활성화되어 있어서 확장 프로그램을 완전히 제거하지 않는 이상 비활성화할 수 없다.
380 조회
0 추천
2025.12.16 등록
OpenAI의 ChatGPT는 2025년 세계에서 가장 인기 있는 생성형 AI 서비스로 1위 자리를 유지했지만, 월요일 발표된 Cloudflare의 연간 리뷰 보고서에 따르면 상위 10위권 밖에서 9월 중순까지 2위로 급상승한 Google의 Gemini, 그리고 Anthropic의 Claude와 Perplexity로부터 치열한 경쟁에 직면했다.중국 챗봇 DeepSeek는 올해 가장 극적인 등장을 했으며, 1월 28일과 2월 3일 사이에 상위 20위권 밖에서 3위로 급등한 후 2025년 나머지 기간 동안 6위에서 10위 사이에서 안정화되었다.ChatGPT는 11월 말까지 Cloudflare의 전체 인터넷 서비스 순위에서 33위로 올라섰으며—Discord, Pinterest, Reddit보다 앞서—12월 기준 Gemini의 13.4%, Perplexity의 6.4%에 비해 AI 검색 시장의 61.3%를 차지하고 있다.
355 조회
0 추천
2025.12.16 등록
최신 AI 언어 모델들은 정치적 설득에 매우 효과적이 되고 있지만, 우려스러운 새로운 연구는 이들이 기시 갤로핑(Gish galloping)이라는 토론 전술—상대방을 빠른 주장의 흐름으로 압도하는 기법—을 통해 사실적 정확성을 희생함으로써 이러한 힘을 얻는다는 것을 밝혀냈습니다.옥스퍼드 대학교, 런던 정치경제대학교, 영국 AI 보안 연구소의 과학자들은 약 77,000명의 참가자를 대상으로 19개의 언어 모델을 테스트했으며, 연구자들은 이를 현재까지 AI 설득에 대한 가장 큰 규모의 체계적 조사라고 설명합니다. 12월 3일 저널 Science에 발표된 연구 결과는 설득력과 진실 사이의 직접적인 트레이드오프를 보여줍니다.​GPT-4o와 같은 언어 모델이 의료 예산이나 이민 정책과 같은 정치적 문제에 대해 "사실과 정보에 집중"하여 사용자를 설득하도록 지시받았을 때, 10분간의 상호작용 동안 약 25개의 주장을 생성했습니다. 2025년 3월 버전의 GPT-4o는 표준 조건에서 78%의 정확한 주장을 만들었지만, 정보로 사용자를 압도하도록 프롬프트되었을 때 정확도는 62%로 급락했습니다. GPT-4.5는 더욱 급격한 하락을 보여 70%에서 56%로 정확도가 떨어졌습니다.기시 갤럽 효과미국의 창조론자 듀안 기시(Duane Gish)의 이름을 딴 이 전술은, 점점 더 검증하거나 반박하기 어려워지는 사실과 통계의 빠른 흐름으로 상대를 압도하는 것을 포함한다. 이 기법은 논증의 질보다 양을 우선시하며, 인류학자 유지니 스콧(Eugenie Scott)이 확립한 정의에 따르면 종종 "반쪽짜리 진실, 왜곡, 그리고 노골적인 거짓말"을 포함한다.​옥스퍼드 연구는 전문화된 훈련 방법과 전략적 프롬프팅이 AI의 설득력을 각각 최대 51%와 27%까지 증가시켰다는 것을 발견했다—이는 종종 모델 규모를 늘리는 것보다 더 큰 향상이었다. 모델 간 설득력의 설명 가능한 변동 중 대략 절반은 정보 밀도, 즉 대화 중 생성된 사실 확인 가능한 주장의 순수한 양으로 추적될 수 있었다.민주주의의 딜레마연구 결과는 초기의 낙관론에서 우려스러운 반전을 보여줍니다. 작년에 과학자들은 AI 챗봇이 합리적인 사실로 음모론을 다룸으로써 잘못된 정보에 맞서 싸울 수 있다는 희망을 제시했습니다. 5월 Nature에 발표된 별도의 연구에서는 개인 정보에 접근할 수 있는 GPT-4가 인간 토론자보다 사용자를 설득할 확률이 81.2% 더 높다는 것을 발견했습니다.​Bloomberg Opinion 칼럼니스트 Parmy Olson에 따르면, 중간 규모의 자원을 가진 캠페인이 약 50,000달러의 컴퓨팅 비용으로 이러한 설득 봇을 배치할 수 있다고 합니다. 연구자들은 이념적 아이디어를 추진하거나, 정치적 불안을 조성하거나, 정치 시스템을 불안정하게 만들려는 누구나 설득 캠페인을 위해 오픈 소스 모델을 사용할 수 있다고 경고합니다. 연구는 설득 효과가 초기 대화 후 최소 한 달 동안 지속되었음을 보여주었습니다.
378 조회
0 추천
2025.12.16 등록
Google은 NotebookLM 리서치 도구와 Gemini 챗봇 간의 통합 기능을 롤아웃하기 시작했으며, 이를 통해 사용자는 전체 노트북을 대화에 직접 첨부하여 출처 기반 분석을 수행할 수 있게 되었다.이 기능은 주말 동안 매우 제한된 방식으로 배포되는 과정에서 포착되었으며, 사용자가 Gemini의 첨부 메뉴에서 노트북을 선택해 챗봇의 추론 모델을 활용하는 동안 인용을 유지하고, Sources 버튼을 통해 전체 NotebookLM 작업 공간으로 다시 이동할 수 있도록 해준다.이번 통합은 연구자 및 지식 노동자들의 핵심 워크플로 병목을 해소하기 위한 것으로, Google이 Microsoft Copilot과 OpenAI의 ChatGPT 다중 파일 기능과 경쟁하는 가운데, 환각 현상을 줄이도록 설계된 NotebookLM의 문서 중심 접근 방식과 Gemini의 대화형 AI를 결합한다.
369 조회
0 추천
2025.12.16 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입