AI 뉴스

ChatGPT, 베네수엘라 침공 뉴스에 "그런 일 없었다" 답변... Claude와 Gemini는 실시간 검색으로 정확히 대응

페이지 정보

작성자 symbolika
작성일 01.04 14:32
294 조회
0 추천
0 비추천

본문

ChatGPT 뉴스 정확도

핵심 요약

• ChatGPT는 베네수엘라 마두로 대통령 체포 소식에 대해 "그런 일은 일어나지 않았다"고 틀린 답변 제공

• Claude Sonnet 4.5와 Gemini 3는 웹 검색 기능으로 실시간 뉴스를 정확히 파악해 응답

• AI 챗봇의 '지식 마감일(knowledge cutoff)' 한계가 실시간 정보 처리의 핵심 장애물로 부각

• 퓨 리서치에 따르면 미국인 75%는 AI 챗봇을 뉴스 소스로 사용하지 않아


현지시간 새벽 2시경, 베네수엘라 카라카스 상공에 미군 헬리콥터가 날아들었고 하늘 아래에서는 폭발음이 울려 퍼졌다. 몇 시간 후, 도널드 트럼프 미국 대통령은 자신의 트루스 소셜 플랫폼에 베네수엘라의 니콜라스 마두로 대통령과 그의 부인이 "체포되어 국외로 호송되었다"고 게시했다. 팸 본디 미국 법무장관은 X에 마두로 부부가 뉴욕 남부지방법원에 기소되었으며 "곧 미국 땅, 미국 법정에서 미국 정의의 분노를 맞이하게 될 것"이라고 밝혔다.

전 세계 질서에 미칠 파장을 가늠하기 어려운 충격적인 사건이었다. 그런데 오늘 아침 ChatGPT에 이 사건에 대해 물어보면, 당신이 지어낸 이야기라고 답했다.

WIRED는 동부표준시 오전 9시 직전, 주요 AI 챗봇인 ChatGPT, Claude, Gemini에 같은 질문을 던졌다. 모든 경우에 대다수 사용자가 경험하는 무료 기본 버전을 사용했다. "정확하고 신뢰할 수 있으며 실시간 답변을 제공한다"고 광고하는 AI 검색 플랫폼 퍼플렉시티에도 같은 질문을 했다.

질문은 이랬다: 미국이 왜 베네수엘라를 침공하고 니콜라스 마두로를 체포했는가? 답변은 극명하게 갈렸다.

Anthropic의 Claude Sonnet 4.5와 Google의 Gemini 3 모델은 시의적절한 응답을 제공해 높은 점수를 받았다. Gemini는 공격이 실제로 발생했음을 확인하고, 미국의 "마약테러" 주장과 공격 이전 해당 지역에서의 미군 증강에 대한 맥락을 제공했으며, 이 모든 것이 베네수엘라의 막대한 석유 및 광물 자원에 접근하기 위한 명분이라는 베네수엘라 정부의 입장도 언급했다. 위키피디아부터 가디언, 미국 외교협회까지 15개의 출처를 인용했다.

Claude는 처음에는 주저했다. "미국이 베네수엘라를 침공하거나 니콜라스 마두로를 체포했다는 정보가 없습니다. 제 지식 마감일인 2025년 1월 기준으로 그런 일은 발생하지 않았습니다"라고 응답했다. 하지만 중요한 다음 단계를 밟았다: "베네수엘라와 마두로에 대한 최신 정보를 검색해 최근 동향이 있는지 확인하겠습니다."

이어서 챗봇은 NBC News는 물론 Breitbart까지 10개의 뉴스 소스를 나열하고, 거의 모든 문장 뒤에 새로운 출처 링크를 제공하며 그날 아침 사건에 대한 간결한 4개 문단 요약을 제공했다.

ChatGPT는 수정하지 않았다. 대신 마두로가 체포되었다는 사실 자체를 단호하게 부인했다. "그런 일은 일어나지 않았습니다"라고 썼다. "미국은 베네수엘라를 침공하지 않았고, 니콜라스 마두로는 체포되지 않았습니다." 그리고 이렇게 합리화했다:

"온라인에서 종종 과장되거나 오해를 불러일으키는 방식으로 묘사되는 실제 사건들이 혼동된 것 같습니다. 실제로 일어난 일은 다음과 같습니다:

❌ 미군의 베네수엘라 침공 없음
❌ 니콜라스 마두로 체포 없음
❌ 미군에 의한 베네수엘라 정부 전복 없음

마두로는 여전히 베네수엘라의 권력을 잡고 있습니다."

ChatGPT는 미국과 베네수엘라 간의 최근 긴장 관계를 설명하고, "자극적인 헤드라인", "소셜 미디어 허위정보", "제재, 기소, 수사적 표현을 실제 군사 행동과 혼동하는 것" 때문에 혼란이 발생할 수 있다고 설명했다.

퍼플렉시티도 마찬가지로 훈계하는 듯한 태도를 보였다. "귀하의 질문 전제는 신뢰할 만한 보도나 공식 기록에 의해 뒷받침되지 않습니다: 니콜라스 마두로를 체포하는 결과를 낳은 미국의 베네수엘라 침공은 없었습니다"라고 응답했다.

퍼플렉시티 대변인 비졸리 샤는 "퍼플렉시티는 100퍼센트 정확하다고 주장한 적 없지만, 더 정확한 AI를 구축하는 데 집중하는 유일한 AI 회사라고는 주장합니다"라고 말했다. OpenAI는 논평 요청에 즉시 응답하지 않았다.

명확히 해야 할 점이 있다. 이것은 예상된 동작이다. ChatGPT 5.1의 "지식 마감일"—새로운 학습 데이터가 더 이상 없는 시점—은 2024년 9월 30일이다. (더 고급 모델인 ChatGPT 5.2는 그 마감일을 2025년 8월 31일로 연장한다.) Claude Sonnet 4.5는 2025년 1월의 "신뢰할 수 있는 지식 마감일"을 가지지만, 학습 데이터는 작년 7월까지 최신이다. 실시간 콘텐츠에 접근하는 웹 검색 도구도 있어 마두로 질문에 답할 수 있었다. Gemini 3 모델도 2025년 1월 지식 마감일을 가지지만, 당연히 최신 정보가 필요한 쿼리에는 구글 검색을 활용한다. 그리고 퍼플렉시티는 활용하는 모델만큼만 우수할 수밖에 없다—이 경우 어떤 모델이었는지는 다시 불분명하지만.

"순수 LLM은 필연적으로 학습 시점에 묶여 과거에 갇혀 있으며, 추론하고, 웹을 검색하고, '비판적으로 생각'하는 등의 본질적 능력에 있어 심각하게 제한됩니다"라고 인지과학자이자 『실리콘밸리 길들이기』 저자인 게리 마커스는 말했다. 마두로 응답과 같은 명백한 문제는 인간의 개입으로 수정할 수 있지만, 그것이 근본적인 문제를 해결하지는 않는다고 마커스는 말한다. "새로운 상황에 직면했을 때 LLM의 신뢰성 문제는 기업이 LLM을 신뢰해서는 안 되는 핵심 이유 중 하나입니다."

좋은 소식은 적어도 사람들이 아직 AI를 주요 뉴스 소스로 의존하지 않는 것으로 보인다는 점이다. 10월에 발표된 퓨 리서치 센터의 설문조사에 따르면, 미국인의 9퍼센트만이 AI 챗봇에서 가끔 또는 자주 뉴스를 얻는다고 답했고, 75퍼센트는 그런 방식으로 뉴스를 얻지 않는다고 답했다. 또한 많은 사람들이 전체 언론 매체, 트럼프 행정부, 객관적 현실 자체보다 ChatGPT의 말을 믿을 것 같지도 않다.

하지만 챗봇이 사람들의 삶에 더 깊이 스며들수록, 그들이 과거에 갇혀 있을 가능성이 높다는 점을 기억하는 것이 중요해질 것이다. 그리고 챗봇이 얼마나 자신 있게 틀릴 수 있는지 항상 주목할 가치가 있다—이는 속보에만 국한되지 않는 특성이다.

2026년 1월 3일 오전 11시 52분(동부표준시) 업데이트: 이 기사는 퍼플렉시티의 논평을 포함하도록 업데이트되었습니다.

댓글 0
전체 1,366 / 11 페이지
• OpenAI가 ChatGPT 사용자를 위한 '연간 리뷰' 기능을 선보였다• 2025년 한 해 동안 보낸 메시지 수, 대화 주제 등 개인화된 통계를 제공한다• AI가 생성한 픽셀 아트 스타일 이미지로 사용자의 관심 주제를 시각화한다• 미국, 영국, 캐나다, 뉴질랜드, 호주 사용자 대상으로 순차 배포 중이다ChatGPT가 연례 리캡 기능을 제공하는 앱 대열에 합류했다. OpenAI는 '연간 리뷰(Year in Review)' 기능을 출시해 2025년 한 해 동안 챗봇에 보낸 메시지 수 등 다양한 통계와 함께, 사용자가 나눈 대화 주제를 반영한 AI 생성 픽셀 아트 스타일 이미지를 제공한다.기자가 받은 이미지에는 레트로 게임 콘솔, 요리, 어항 설치 관련 질문을 반영하듯 수족관 옆에 게임 카트리지, 인스턴트팟, 컴퓨터 화면이 그려져 있었다.이 외에도 대화에서 가장 많이 등장한 주제 요약, 채팅 스타일 설명, 가장 많은 메시지를 보낸 요일 등 개인화된 분석이 포함된다. 또한 '프로듀서' 또는 '내비게이터' 같은 '아키타입'으로 사용자를 분류하고, '인스턴트팟 달인'처럼 맞춤형 칭호도 부여한다.연간 리캡 기능은 현재 미국, 영국, 캐나다, 뉴질랜드, 호주 사용자에게 순차적으로 배포되고 있다. 단, ChatGPT에 과거 대화 기록과 개인 선호도 참조 권한을 허용한 경우에만 이용할 수 있다. 모바일이나 데스크톱 ChatGPT 앱 홈페이지에서 해당 옵션을 선택하거나, ChatGPT에 "show my year in review"라고 입력하면 자신의 연간 리뷰를 확인할 수 있다.
287 조회
0 추천
2025.12.31 등록
• 미국 연방거래위원회(FTC), 'AI 규제 작전' 일환으로 허위 광고 AI 기업들 대대적 단속• DoNotPay, 검증 없이 '로봇 변호사'가 인간 변호사를 대체할 수 있다고 허위 주장• FTC, AI 서비스로 소비자 기만하는 행위에 법적 예외 없음을 분명히 경고DoNotPay가 자사 서비스가 유효한 법률 문서를 작성할 수 있다고 소비자들을 오도한 혐의에 대해 19만 3천 달러를 지불하기로 합의했다."세계 최초의 로봇 변호사"를 제공한다고 주장해온 DoNotPay가 미국 연방거래위원회(FTC)와 19만 3천 달러 합의에 도달했다고 FTC가 화요일 발표했다. 이번 조치는 AI 서비스를 이용해 고객을 속이거나 사기치는 기업들을 단속하기 위한 FTC의 새로운 법 집행 노력인 'AI 규제 작전(Operation AI Comply)'의 일환이다.FTC 고발장에 따르면, DoNotPay는 "2천억 달러 규모의 법률 산업을 인공지능으로 대체하겠다"고 주장했으며, 자사의 "로봇 변호사"가 법률 문서 작성에서 인간 변호사의 전문성과 결과물을 대신할 수 있다고 광고했다. 그러나 FTC는 이 회사가 이러한 주장을 뒷받침할 어떠한 테스트도 수행하지 않았다고 밝혔다. 고발장에는 다음과 같이 적시되어 있다:"이 서비스의 어떤 기술도 연방 및 주 법률, 규정, 판결의 포괄적이고 최신의 자료나 이러한 법률을 사실관계에 적용하는 방법에 대해 훈련받지 않았다. DoNotPay 직원들은 대부분의 법률 관련 기능이 생성하는 법률 문서와 조언의 품질과 정확성을 테스트하지 않았다. DoNotPay는 변호사를 고용한 적이 없으며, 관련 법률 전문 지식을 갖춘 변호사를 고용하여 서비스의 법률 관련 기능의 품질과 정확성을 테스트한 적도 없다."고발장은 또한 이 회사가 소비자들에게 인간을 고용하지 않고도 AI 서비스를 사용해 폭행 소송을 제기할 수 있다고 말했으며, 소비자의 이메일 주소만으로 소규모 사업체 웹사이트의 법적 위반 사항을 확인할 수 있다고 주장했다고 밝혔다. DoNotPay는 이를 통해 기업들이 12만 5천 달러의 법률 비용을 절약할 수 있다고 주장했지만, FTC는 이 서비스가 효과적이지 않았다고 말했다.FTC는 DoNotPay가 혐의 해결을 위해 19만 3천 달러를 지불하고, 2021년부터 2023년 사이에 가입한 소비자들에게 법률 관련 서비스의 한계에 대해 경고하기로 합의했다고 밝혔다. 또한 DoNotPay는 증거를 제시하지 않고는 어떤 전문 서비스도 대체할 수 있다고 주장할 수 없게 되었다.FTC는 AI 서비스를 이용해 고객을 오도한 다른 기업들에 대한 조치도 발표했다. 여기에는 AI "글쓰기 보조" 서비스 Rytr가 포함되는데, FTC는 이 회사가 가입자들에게 AI로 생성된 가짜 리뷰를 작성할 수 있는 도구를 제공한다고 밝혔다. Rytr에 대한 조치는 FTC가 AI로 생성된 것을 포함해 모든 가짜 리뷰의 생성 및 판매를 금지하는 최종 규정을 발표한 지 한 달여 만에 이루어졌다. 이 규정이 곧 발효되면 FTC는 기업들에 대해 위반 건당 최대 51,744달러의 벌금을 부과할 수 있다.FTC는 또한 소비자들에게서 최소 2천 5백만 달러를 사취한 혐의로 Ascend Ecom을 상대로 소송을 제기했다. Ascend는 고객들에게 AI 기반 도구를 사용하면 아마존과 같은 전자상거래 플랫폼에서 월 수만 달러의 수익을 창출하는 온라인 상점을 시작할 수 있다고 약속했다.FTC 의장 리나 칸은 "AI 도구를 사용해 사람들을 속이거나 오도하거나 사기치는 것은 불법"이라며 "FTC의 법 집행 조치는 현행법에 AI 예외 조항이 없음을 분명히 한다. 이러한 시장에서 불공정하거나 기만적인 관행을 단속함으로써 FTC는 정직한 기업과 혁신가들이 공정한 기회를 얻고 소비자들이 보호받을 수 있도록 보장하고 있다"고 밝혔다.
290 조회
0 추천
2025.12.31 등록
• OpenAI, ChatGPT의 청소년(13~17세) 대응 지침인 Model Spec에 4가지 새로운 원칙 추가• Anthropic, 18세 미만 사용자를 탐지하고 계정을 비활성화하는 시스템 개발 중• 양사 모두 AI 챗봇의 정신 건강 영향에 대한 규제 압력에 대응하는 조치OpenAI와 Anthropic이 미성년 사용자를 감지하는 새로운 방식을 도입한다. OpenAI는 13세에서 17세 사이 사용자와 ChatGPT가 어떻게 상호작용해야 하는지에 대한 지침을 업데이트했으며, Anthropic은 18세 미만 사용자를 식별하고 차단하는 새로운 방법을 개발 중이다.목요일 OpenAI는 ChatGPT의 행동 지침인 Model Spec에 18세 미만 사용자를 위한 4가지 새로운 원칙을 포함시킨다고 발표했다. 이제 ChatGPT는 "다른 목표와 충돌하더라도 청소년 안전을 최우선으로" 두는 것을 목표로 한다. 이는 "최대한의 지적 자유"와 같은 다른 사용자 이익이 안전 문제와 충돌할 때 청소년을 더 안전한 방향으로 안내한다는 것을 의미한다.또한 ChatGPT는 오프라인 관계를 장려하는 것을 포함하여 "실제 세계의 지원을 촉진"해야 한다고 명시하며, 젊은 사용자와 상호작용할 때 ChatGPT가 어떻게 명확한 기대치를 설정해야 하는지를 설명한다. Model Spec은 ChatGPT가 "청소년을 청소년답게 대해야" 하며, 무시하는 듯한 답변을 제공하거나 청소년을 성인처럼 대하는 대신 "따뜻함과 존중"을 제공해야 한다고 명시한다.이번 변화는 AI 기업들과 그들의 챗봇이 정신 건강에 미칠 수 있는 잠재적 영향에 대해 국회의원들의 압력이 높아지는 가운데 이루어졌다. OpenAI는 현재 ChatGPT가 스스로 목숨을 끊은 청소년에게 자해 및 자살에 대한 지시를 제공했다는 소송에 직면해 있다. OpenAI는 이후 부모 통제 기능을 도입했으며 ChatGPT가 더 이상 청소년과 자살에 대해 대화하지 않을 것이라고 밝혔다. 이는 다양한 서비스에 대한 의무적 연령 확인을 포함하는 더 큰 온라인 규제 추진의 일환이다.OpenAI는 ChatGPT의 Model Spec 업데이트로 인해 "대화가 더 위험한 영역으로 이동할 때 더 강력한 보호 장치, 더 안전한 대안, 그리고 신뢰할 수 있는 오프라인 지원을 찾도록 권장"하는 결과가 나타날 것이라고 밝혔다. 회사는 또한 "임박한 위험"의 징후가 있을 경우 ChatGPT가 청소년에게 응급 서비스나 위기 자원에 연락하도록 촉구할 것이라고 덧붙였다.이 변화와 함께 OpenAI는 누군가의 나이를 추정하려는 연령 예측 모델 출시의 "초기 단계"에 있다고 밝혔다. 누군가 18세 미만일 수 있다고 감지되면 OpenAI는 자동으로 청소년 보호 장치를 적용할 것이다. 또한 시스템에 의해 잘못 표시된 성인에게는 연령을 확인할 기회를 제공할 것이다.18세 미만 사용자의 Claude 사용을 허용하지 않는 Anthropic은 미성년 사용자의 계정을 감지하고 비활성화하는 데 사용할 조치를 도입한다. 회사는 "사용자가 미성년자일 수 있음을 나타내는 미묘한 대화 신호"를 감지할 수 있는 새로운 시스템을 개발 중이며, 이미 채팅 중 자신을 미성년자로 밝히는 사용자를 표시하고 있다고 밝혔다.Anthropic은 또한 자살 및 자해에 대한 프롬프트에 Claude가 어떻게 반응하도록 훈련하는지, 그리고 해로운 사고를 재확인할 수 있는 아첨성을 줄이는 진행 상황을 설명했다. 회사는 최신 모델이 "현재까지 가장 덜 아첨적"이며, Haiku 4.5가 37%의 시간 동안 아첨적인 행동을 수정하여 가장 좋은 성과를 보였다고 밝혔다.Anthropic은 "표면적으로 이 평가는 모든 모델에 상당한 개선의 여지가 있음을 보여준다"며 "결과가 모델의 따뜻함이나 친근함과 아첨성 사이의 균형을 반영한다고 생각한다"고 말했다.
285 조회
0 추천
2025.12.31 등록
• OpenAI, 구글, 마이크로소프트 등 주요 AI 기업들이 'AI 에이전트' 개발에 총력을 기울이고 있다• AI 에이전트는 사람의 개입 없이 예약, 구매, 업무 처리 등을 자율적으로 수행하는 프로그램이다• 지난 12개월간 AI 에이전트 스타트업에 82억 달러가 투자되며 전년 대비 81.4% 증가했다• 기업들은 막대한 AI 개발 비용을 회수할 수익 모델로 에이전트를 주목하고 있다• 그러나 AI 환각 현상과 신뢰성 문제로 실용화까지는 아직 갈 길이 멀다는 지적도 나온다인류는 수 세기에 걸쳐 업무를 자동화해왔다. 이제 AI 기업들은 인간의 효율성 추구 본능을 활용해 수익을 창출할 방법을 찾았고, 그 해결책에 '에이전트'라는 이름을 붙였다.AI 에이전트란 최소한의 인간 개입으로 업무를 수행하고, 의사결정을 내리며, 환경과 상호작용하는 자율 프로그램을 말한다. 현재 AI 분야의 모든 주요 기업이 이 기술에 집중하고 있다. 마이크로소프트는 고객 서비스와 행정 업무 자동화를 위한 '코파일럿'을 개발했고, 구글 클라우드 CEO 토마스 쿠리안은 최근 6가지 AI 생산성 에이전트 구상을 발표했다. 구글 딥마인드는 AI 에이전트 훈련용 시뮬레이션 개발을 위해 OpenAI의 소라 공동 책임자를 영입하기도 했다. 앤트로픽은 AI 챗봇 클로드에 사용자가 직접 'AI 어시스턴트'를 만들 수 있는 기능을 추가했으며, OpenAI는 범용 인공지능(AGI) 달성을 위한 5단계 로드맵에서 에이전트를 2단계로 설정했다.물론 컴퓨팅 분야에는 이미 수많은 자동화 시스템이 존재한다. 웹사이트의 팝업 고객 서비스 봇, 알렉사 스킬스 같은 음성 비서, 간단한 IFTTT 스크립트를 사용해본 사람이 많을 것이다. 그러나 AI 기업들은 '에이전트'가—절대 봇이라 부르지 말 것—이전과는 다르다고 주장한다. 단순하고 반복적인 명령을 따르는 대신, 에이전트는 환경과 상호작용하고, 피드백을 통해 학습하며, 지속적인 인간 개입 없이도 스스로 결정을 내릴 수 있다는 것이다. 구매, 여행 예약, 회의 일정 조율 같은 업무를 역동적으로 처리하고, 예상치 못한 상황에 적응하며, 다른 인간이나 AI 도구와도 상호작용할 수 있다.AI 기업들은 에이전트가 값비싸고 강력한 AI 모델을 수익화할 방법이 될 것으로 기대한다. 벤처 캐피털은 기술과 인간의 상호작용 방식을 혁신하겠다고 약속하는 AI 에이전트 스타트업에 쏟아지고 있다. 기업들은 고객 서비스부터 데이터 분석까지 모든 것을 에이전트가 처리하는 효율성의 도약을 꿈꾼다. 개인 사용자에게 AI 기업들은 일상적인 업무가 자동화되어 창의적이고 전략적인 일에 더 많은 시간을 쓸 수 있는 새로운 생산성 시대를 제시하고 있다. 진정한 신봉자들의 궁극적 목표는 단순한 도구가 아닌 진정한 파트너로서의 AI를 만드는 것이다.OpenAI CEO 샘 알트만은 올해 초 MIT 테크놀로지 리뷰와의 인터뷰에서 사용자들이 진정으로 원하는 것은 "그저 곁에서 당신을 도와주는 존재"라고 말했다. 알트만은 킬러 AI 앱은 간단한 업무는 즉시 처리하고, 복잡한 문제는 알아서 해결한 뒤 답을 가져다주는 것이어야 한다고 설명했다. "내 삶의 모든 것, 모든 이메일, 모든 대화를 알고 있지만 나의 연장처럼 느껴지지 않는 초유능한 동료" 같은 존재 말이다. 테크 기업들은 적어도 1970년대부터 개인 비서 자동화를 시도해왔고, 이제 드디어 가까워졌다고 약속하고 있다.OpenAI의 연례 개발자 행사인 Dev Day를 앞두고 열린 기자 간담회에서 개발자 경험 책임자 로맹 위에는 새로운 실시간 API를 활용한 어시스턴트 에이전트를 시연했다. 위에는 에이전트에게 예산과 조건을 제시한 뒤 가상의 상점에 전화를 걸어 초콜릿 딸기 400개를 주문하도록 했다.이 서비스는 2018년 구글이 선보인 예약 전화 봇 '듀플렉스'와 유사하다. 하지만 당시 봇은 가장 단순한 시나리오만 처리할 수 있었고, 실제로 통화의 4분의 1은 사람이 대신 처리한 것으로 밝혀졌다.위에는 영어로 주문을 시연했지만, 도쿄에서는 더 복잡한 시연을 했다고 밝혔다. 에이전트가 일본어로 호텔 객실을 예약하고, 완료 후 영어로 다시 전화해 확인하도록 한 것이다. 위에는 "물론 저는 일본어 부분은 이해하지 못합니다—그냥 알아서 처리하는 거죠"라고 말했다.그러나 이 시연은 기자들 사이에서 즉각적인 우려를 불러일으켰다. AI 어시스턴트가 스팸 전화에 악용될 수 있지 않을까? 왜 스스로를 AI 시스템이라고 밝히지 않는가? (위에는 공식 Dev Day에서 시연을 수정해 에이전트가 "로맹의 AI 어시스턴트"라고 자신을 소개하도록 했다고 참석자가 전했다.) 불안감이 역력했고, 이는 놀라운 일이 아니었다—에이전트 없이도 AI 도구는 이미 속임수에 사용되고 있기 때문이다.또 다른, 어쩌면 더 시급한 문제도 있었다. 시연이 제대로 작동하지 않은 것이다. 에이전트는 충분한 정보가 없었고 디저트 맛을 잘못 기록해 바닐라, 딸기 같은 맛을 열에 자동 입력했다. 정보가 없다고 말하는 대신 말이다. 에이전트는 다단계 작업이나 예상치 못한 상황에서 자주 문제를 일으킨다. 또한 기존 봇이나 음성 비서보다 훨씬 많은 에너지를 소모한다. 추론하거나 여러 시스템과 상호작용할 때 상당한 연산 능력이 필요해 대규모 운영 비용이 높다.AI 에이전트는 잠재력의 도약을 제공하지만, 일상적인 업무에서는 아직 봇, 어시스턴트, 스크립트보다 크게 나은 점이 없다. OpenAI와 다른 연구소들은 강화학습을 통해 추론 능력을 향상시키면서, 무어의 법칙이 계속해서 더 저렴하고 강력한 컴퓨팅을 제공하기를 바라고 있다.그렇다면 AI 에이전트가 아직 그다지 유용하지 않은데 왜 이 개념이 이토록 인기일까? 한마디로 시장 압력 때문이다. 이 기업들은 강력하지만 비용이 많이 드는 기술을 보유하고 있으며, 사용자에게 비용을 청구할 수 있는 실용적인 활용 사례를 찾는 데 필사적이다. 약속과 현실 사이의 격차가 투자를 끌어들이는 매력적인 과대광고 사이클을 만들어내고 있으며, 공교롭게도 OpenAI는 에이전트를 홍보하기 시작할 때쯤 66억 달러를 투자받았다.AI 에이전트 스타트업들은 지난 12개월간 156건의 거래를 통해 82억 달러의 투자를 유치했으며, 이는 전년 대비 81.4% 증가한 수치라고 피치북 데이터가 밝혔다. 더 잘 알려진 프로젝트 중 하나는 세일즈포스의 최신 프로젝트와 유사한 고객 서비스 에이전트를 제공하는 시에라로, 전 세일즈포스 공동 CEO 브렛 테일러가 설립했다. 변호사를 위한 AI 에이전트를 제공하는 하비, 세금 처리를 위한 AI 에이전트 택스GPT도 있다.에이전트에 대한 열광에도 불구하고, 법률이나 세금 같은 고위험 업무에서 이들을 정말 신뢰할 수 있는지는 명백한 의문으로 남는다. ChatGPT 사용자들을 자주 곤란하게 만든 AI 환각 현상에 대한 해결책은 아직 보이지 않는다. 더 근본적으로, IBM이 1979년에 선견지명 있게 밝혔듯이 "컴퓨터는 결코 책임을 질 수 없다"—그리고 그 결과로 "컴퓨터는 결코 경영 결정을 내려서는 안 된다." 자율적인 의사결정자라기보다, AI 어시스턴트는 그들의 본질 그대로 바라봐야 한다: 저위험 업무를 위한 강력하지만 불완전한 도구. 이것이 AI 기업들이 사람들에게 청구하려는 거금의 가치가 있을까?현재로서는 시장 압력이 우세하며, AI 기업들은 수익화에 박차를 가하고 있다. OpenAI의 새 최고제품책임자 케빈 웨일은 기자 간담회에서 "2025년은 에이전트 시스템이 마침내 주류에 진입하는 해가 될 것"이라고 말했다. "제대로 해낸다면, 정말 중요한 인간적인 일에 더 많은 시간을 쓰고, 휴대폰을 쳐다보는 시간은 조금 줄이는 세상으로 가게 될 것입니다."
285 조회
0 추천
2025.12.31 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입