AI 뉴스

MIT, AI 모델이 의미보다 문법적 지름길에 의존한다는 것을 발견

페이지 정보

작성자 xtalfi
작성일 2025.11.26 17:44
476 조회
0 추천
0 비추천

본문

a1a0f41e7a3c8aede0583d1a137589de_1764146509_5877.png
 

MIT 연구진은 대규모 언어 모델의 신뢰성을 훼손할 수 있는 취약점을 발견했으며, GPT-4 및 Llama와 같은 고급 AI 시스템조차도 때때로 진정한 이해보다는 문법적 지름길을 기반으로 질문에 답한다는 사실을 밝혔습니다.

신경 정보 처리 시스템 학회(Conference on Neural Information Processing Systems)에서 발표될 예정인 이 연구는 LLM이 특정 문장 패턴을 특정 주제와 잘못 연관시킨 다음, 실제 질문을 이해하는 대신 이러한 학습된 패턴에 의존할 수 있다는 것을 발견했습니다. 이러한 결함은 정확한 응답이 중요한 의료, 금융 및 고객 서비스 분야에 배포된 AI 시스템에 위험을 초래합니다.


의미보다 문법

MIT 부교수 Marzyeh Ghassemi가 이끄는 연구팀은 Northeastern University와 Meta의 연구원들과 함께, 모델이 훈련 중에 “구문 템플릿”—품사의 패턴—을 특정 도메인과 연결하는 방법을 학습하는 과정을 입증했다.

MIT News 기사에 따르면, LLM은 “파리는 어디에 위치해 있나요?“가 지리 질문과 관련된 특정 문법 구조를 따른다는 것을 학습할 수 있다. 문법적으로는 유사하지만 “빠르게 앉다 파리 흐림?“과 같이 말이 되지 않는 질문이 제시될 때, 모델은 질문이 무의미함에도 불구하고 여전히 “프랑스”라고 답할 수 있다.

Northeastern University 대학원생이자 MIT 방문 학생인 Chantal Shaib는 “이것은 모델이 질문에 올바르게 답하기 위해 학습하는 간과된 유형의 연관성입니다”라고 말했다. 연구원들은 구문을 동일하게 유지하면서 단어를 동의어, 반의어 또는 무작위 단어로 대체했을 때, LLM이 질문이 완전히 말도 안 되는 경우에도 종종 올바른 답변을 생성한다는 것을 발견했다.


보안 및 테스트 시사점

이 취약점은 심각한 보안상의 영향을 미칩니다. arXiv에 게시된 연구에 따르면, 공격자들은 모델이 무해한 콘텐츠와 연관시키는 구문 패턴을 사용하여 유해한 요청을 표현함으로써 안전 가드레일을 우회하기 위해 이 현상을 악용할 수 있습니다.

연구에 참여한 MIT 대학원생 Vinith Suriyakumar는 “이 연구를 통해 LLM의 보안 취약점을 해결하기 위해 더욱 강력한 방어 체계가 필요하다는 것이 분명해졌습니다”라고 말했습니다. 연구진은 GPT-4와 Llama를 포함한 사전 훈련된 모델에서 이를 테스트했으며, 학습된 행동이 성능을 크게 저하시킨다는 것을 발견했습니다.

문제를 해결하기 위해 연구팀은 개발자들이 자신의 모델이 이러한 잘못된 구문-도메인 상관관계에 의존하는지 평가할 수 있는 자동 벤치마킹 절차를 개발했습니다. 연구진은 더 다양한 구문 템플릿을 포함한 증강된 훈련 데이터를 활용한 완화 전략을 탐구할 계획이며, 복잡한 다단계 작업을 위해 설계된 추론 모델에서 이 현상을 연구할 예정입니다.

댓글 0
전체 1,366 / 56 페이지
정부가2027년까지고도자율주행차(레벨4)를상용화하고글로벌3대자율주행강국으로도약하겠다는목표를제시했다.구윤철부총리겸기획재정부장관은26일경제관계장관회의겸성장전략태스크포스(TF)에서'자율주행차산업경쟁력제고방안'을발표하며대규모실증기반구축과규제합리화에나선다고밝혔다.​한국의자율주행차기술은현재미국자동차공학회(SAE)기준레벨3(조건부자동화)수준으로,미국과중국의레벨4(고도자동화)와격차가있는상황이다.자율주행상위20개기업중미국이14곳,중국이4곳을차지하는반면한국은1곳에그친다.​도시전역실증구역조성,100대투입정부는내년부터도시전체가실증구역인'자율주행실증도시'를조성하고100대이상의자율주행차를투입할계획이다.현재는전국47곳의시범운행지구에서만제한적으로실증이이뤄지고있으나,미국샌프란시스코나중국우한처럼도시단위대규모실증으로전환한다.실증도시에는완성차,관제플랫폼,자율주행소프트웨어등대기업과스타트업이참여하는'K-자율주행'협력모델이구축된다.​농어촌등교통취약지역에서의자율주행버스운영지원도확대한다.자율주행개발사에만허용되던임시운행허가는운수사업자에게도개방되며,교통약자보호구역내에서도안전계획수립을전제로자율주행이가능해진다.​GPU지원·AI학습센터,2029년구축정부는자율주행차전용그래픽처리장치(GPU)를확보·지원하고2029년까지인공지능(AI)학습센터를구축해기업의연구개발을뒷받침한다.가명처리하지않은원본영상데이터의R&D활용을허용해인식정확도를최대25%향상시킬방침이다.​자율주행차에특화된차체플랫폼과반도체등핵심부품개발을통해국내생산망도구축한다.AI가학습한데이터를바탕으로스스로판단·제어하는엔드투엔드(E2E)기술개발도지원한다.​완전자율주행시대에대비한제도정비도추진된다.정부는자율주행차의운행관리의무를맡을법적책임주체개념을도입하고,사고시제조사의자료제출명령제를마련해입증부담을줄일계획이다.
508 조회
0 추천
2025.11.26 등록
카카오가스위스제네바에서열린유엔인권포럼에서인공지능(AI)개발전과정에인권보호체계를적용하고있다고밝혔다.회사는한국어와문화적맥락에최적화된AI안전모델을오픈소스로공개하며기술의공공기여를확대하고있다.​카카오는지난24일부터26일까지UN산하인권최고대표사무소(OHCHR)주최'제14차UN기업과인권포럼'에참석해인권기반AI와기술의공공기여사례를발표했다고26일밝혔다.이번포럼은2011년채택된UN기업과인권이행원칙(UNGPs)의실천을논의하는글로벌회의로,정부·기업·지역공동체·UN기구·인권단체·학계등다양한이해관계자가참석했다.​인권중심AI거버넌스체계구축카카오는'인공지능시대의인권증진'세션에참여해AI기술개발과서비스출시,운영전반에인권관점을내재화한거버넌스를소개했다.하진화AI세이프티시니어매니저는"카카오는AI기술개발및운영전과정에인권보호체계를접목하고있으며,한국어와문화맥락에최적화된AI가드레일모델을오픈소스로공개하는등공공조달의신뢰성을위한기반을마련하고있다"고설명했다.​카카오의'안전한AI핵심체크리스트'는국가인권위원회의'AI인권영향평가도구'를주요참고문헌으로삼아제작됐으며,그룹AI윤리원칙인'카카오그룹의책임있는AI가이드라인'에도인권관련원칙을명확히반영했다.'디지털아동·청소년보호체크리스트'역시유니세프의디지털아동영향평가를토대로마련됐다.​오픈소스공개로생태계기여카카오는지난5월AI서비스의안전성과신뢰성을검증하는가드레일모델'카나나세이프가드'를국내기업최초로오픈소스로공개했으며,현재카카오주요AI서비스에적용중이다.​최근에는한국정보통신기술협회(TTA),KAIST와함께생성형AI안전성평가데이터셋'AssurAI'를공동개발했다.총1만1480건으로구성된이데이터셋은글로벌AI위험분류체계를기반으로국내사회·문화적맥락을반영했으며,허깅페이스를통해연구·평가용으로공개됐다.​김경훈카카오AI세이프티리더는"기술의투명성확보와공공기여확대를통해인권존중기업으로서역할을강화하고,지속가능한기술생태계와사람중심의AI구현에힘쓸것"이라고말했다.
515 조회
0 추천
2025.11.26 등록
배달의민족이새로운AI배차시스템'로드러너'도입을둘러싼논란속에서라이더월평균소득이29%증가했다는데이터를공개하며시스템확대의지를밝혔다.하지만라이더와자영업자들은하루전대규모집회를열고전면폐기를요구하며강하게반발하고있다.배민의물류서비스를전담하는우아한청년들은26일로드러너시범운영지역인화성시에서주평균40시간이상활동하는전업라이더의월평균소득이424만원으로,도입이전6개월의329만원대비29%증가했다고밝혔다.같은기간인근도시(수원·평택·용인)전업라이더의월평균수입319만원보다33%높은수치다.​우아한청년들관계자는"기존배달앱대비로드러너의안정적인배차와운행동선개선효과로라이더의배달효율성이향상되고전반적인라이더수익이향상됐다"고설명했다.​라이더·자영업자1천여명집회로맞서이발표는로드러너도입반대집회가열린다음날나와주목된다.민주노총공공운수노조라이더유니온지부와공정한플랫폼을위한사장협회등은25일서울송파구배민본사앞에서1천여명이참여한가운데'배민로드러너도입저지공동투쟁대회'를개최했다.​구교현라이더유니온지부장은"정확한기준도모르는등급에시간당배달건수,수락률이반영된다니무턱대고과속하며충성경쟁만할수밖에없다"며"실제수입증가가일어났다면그건라이더가자기몸을갈아넣은결과일것"이라고비판했다.​로드러너는배민모회사인독일딜리버리히어로(DH)가개발한AI기반배차시스템으로,라이더가사전에근무일정을등록하면AI가자동으로배달건을배차한다.기존배민커넥트와달리8단계등급제를적용해높은등급의라이더가좋은시간대를우선선택할수있다.​등급제·수수료유출우려확산라이더들은등급산정기준이투명하게공개되지않아위험운전이증가하고,저등급라이더는일할기회조차얻기어렵다고주장한다.자영업자들은주문가능거리가일방적으로제한돼매출이감소했다고호소했다.​박정훈공공운수노조부위원장은"로드러너를전국으로확대하는이유는모회사딜리버리히어로에막대한로열티를보내기위한것"이라며"착취를강화해이윤을빼먹으려는시도를막아야한다"고강조했다.​배민은올해4월부터경기오산·화성지역에서로드러너를시범도입했으며,제주도입은현장반발로연기된상태다.
521 조회
0 추천
2025.11.26 등록
한국이오픈AI의인공지능챗봇챗GPT국가별매출에서미국에이어세계2위를차지한것으로나타났다.앱마켓분석업체센서타워가26일공개한'챗GPT앱분석보고서'에따르면,한국의누적매출액은2억달러(약2922억원)로전체의5.4%를차지하며미국(35.4%)에이어2위에올랐다.​특히주목할점은한국의다운로드순위는21위(1.5%)에불과하지만,매출에서는압도적인2위를기록했다는것이다.이는한국사용자들의유료결제의향이매우높다는것을보여준다.실제로한국의다운로드당매출(RPD)은8.7달러로미국(8.8달러)과단0.1달러차이에불과했다.​AI시장의뜨거운관심입증한국에서챗GPT는지난8월역대최고다운로드수를,10월에는최고매출을기록했다.센서타워에따르면올해1월1일부터11월20일까지챗GPT는한국앱마켓전체에서다운로드1위,매출4위를차지했다.상위권이대부분게임으로채워진가운데비게임앱으로이같은성과를거둔것은이례적이라는평가다.​경쟁사대비우위도두드러진다.구글의제미나이와비교해다운로드는3배,일일활성사용자는8배이상많았으며,앤스로픽의클로드보다매출은10배이상높았다.웹에서도챗GPT는유튜브,네이버,구글,다음에이어전체5위를기록했으며,방문자1인당월평균체류시간은367분으로2위네이버의1.7배에달했다.​글로벌AI기업들의한국진출가속화이러한시장성을인식한글로벌AI기업들이한국진출을가속화하고있다.오픈AI는지난5월한국법인설립과서울사무실개설을공식발표했으며,앤스로픽도10월2026년초강남에서울사무실을개설할계획을밝혔다.앤스로픽의폴스미스최고상업책임자는"전세계앤스로픽사용자상위5개국중3개국이한국,일본,인도등아시아에위치하고있다"고설명했다.​센서타워는"전통적인검색엔진중심의상위순위속에서AI기반서비스가본격적으로자리잡기시작했다"며"한국의정보탐색방식이빠르게변화하고있음을시사한다"고분석했다.
547 조회
0 추천
2025.11.26 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입