AI 뉴스

소니, 모델 전반의 편향성을 드러내는 윤리적 AI 데이터셋 공개

페이지 정보

작성자 xtalfi
작성일 11.06 14:04
234 조회
0 추천
0 비추천

본문

2192245744_rlcnht.jpg

(퍼플렉시티가 정리한 기사)


소니 AI는 화요일에 컴퓨터 비전 모델의 편향성을 드러내기 위해 설계된 획기적인 동의 기반 데이터셋인 Fair Human-Centric Image Benchmark (FHIBE)를 출시했습니다. Nature에 게재된 이번 출시는 AI 시스템 전반의 공정성을 평가하기 위해 특별히 제작된 최초의 공개적으로 이용 가능한 전 세계적으로 다양한 데이터셋을 나타내며, 기존 모델 중 윤리적 기준을 완전히 충족하는 것은 없다는 사실을 밝혀냅니다.​

이 데이터셋은 81개국에서 온 1,981명의 자원자들의 10,318개 이미지로 구성되어 있으며, 모두 사전 동의와 공정한 보상을 받고 수집되었습니다. 참가자들은 언제든지 자신의 이미지를 철회할 권리를 보유하며, 이는 허가 없이 웹 데이터를 수집하는 업계 관행에서 벗어난 것입니다.​


AI 모델 전반에 걸쳐 광범위한 편향성 발견

Sony AI의 테스트는 현재 컴퓨터 비전 시스템에서 "she/her/hers" 대명사를 사용하는 개인에 대한 정확도가 낮은 것을 포함하여 지속적인 편향이 존재함을 밝혀냈습니다. 벤치마크는 이러한 격차가 부분적으로 해당 인구 집단의 더 큰 헤어스타일 다양성에서 비롯된다는 것을 확인했는데, 이는 공정성 연구에서 이전에 간과되었던 요인입니다.​

모델이 직업에 대한 중립적인 질문을 받았을 때 더 우려스러운 패턴이 나타났습니다. AI 시스템은 인구통계학적 특성에 기반하여 대상을 성 노동자, 마약 거래상 또는 도둑으로 묘사하면서 해로운 고정관념을 자주 강화했습니다. 범죄 활동에 대해 질문을 받았을 때, 모델은 아프리카계 또는 아시아계 조상을 가진 개인, 더 어두운 피부톤을 가진 사람, 그리고 "he/him/his"로 식별되는 사람들에 대해 더 높은 비율로 유해한 응답을 생성했습니다.​

Sony AI의 연구에 따르면, "기존의 대규모 언어 모델 중 FHIBE의 모든 공정성 테스트를 통과한 것은 없었으며, 이는 AI의 내재된 편향과 포용성 부족이 여전히 지속적인 문제로 남아 있음을 보여줍니다".​


새로운 업계 표준 설정

소니 그룹의 글로벌 AI 거버넌스 책임자인 Alice Xiang은 오랜 업계 관행을 해결하는 데 있어 이 데이터셋의 중요성을 강조했습니다. "업계는 너무 오랫동안 다양성이 부족하고, 편향을 강화하며, 적절한 동의 없이 수집된 데이터셋에 의존해 왔습니다"라고 그녀는 말했습니다. "이 프로젝트는 사전 동의, 개인정보 보호, 공정한 보상, 안전, 다양성 및 유용성에 대한 모범 사례를 통합한 책임 있는 데이터 수집이 가능하다는 것을 보여줍니다."​

개발 비용은 3년 동안 100만 달러 미만이었으며, Nature의 사설 보도에 따르면 "많은 기술 기업들에게는 바다의 물 한 방울"에 불과한 금액입니다. 이 비교적 적은 투자는 윤리적 데이터 수집이 엄청나게 비싸다는 업계의 주장에 이의를 제기합니다.​

소니 AI의 사장인 Michael Spranger는 이번 출시를 "AI 데이터셋에 대한 새로운 업계 기준"을 확립하는 것으로 평가하며, "데이터를 책임감 있게 수집하는 것이 가능하다는 것을 증명하고, 처음부터 신뢰할 수 있는 AI를 구축하는 데 도움이 된다"고 말했습니다.​

FHIBE 데이터셋은 현재 fairnessbenchmark.ai.sony에서 공개적으로 이용 가능하며, 전 세계 연구자와 개발자에게 컴퓨터 비전 시스템의 편향을 식별하고 완화할 수 있는 도구를 제공합니다.

댓글 0
전체 1,160 / 105 페이지
(퍼플렉시티가정리한기사)Microsoft는Azure클라우드플랫폼에서단일랙시스템으로초당110만토큰이라는전례없는성능을달성하며AI처리장벽을무너뜨렸습니다.이는백만토큰임계값을처음으로돌파한것으로,AI추론성능에대한새로운업계벤치마크를확립했습니다.​NVIDIA의최첨단GB300GPU로구동되는AzureNDGB300v6가상머신을사용하여달성한이이정표는GB200시스템으로달성한Microsoft의이전기록인초당865,000토큰대비27%향상된수치입니다.이성능테스트는업계표준인Llama270B모델을사용한80분간의벤치마크실행동안Signal65에의해독립적으로검증되었습니다.​엔터프라이즈AI를위한획기적인성능이성과는AI배포의경제성을근본적으로변화시켜,기업들이엄격한규정준수요구사항을유지하면서수천명의동시사용자를지원할수있게합니다.각NVIDIAGB300GPU는초당15,200개의토큰을처리하여이전세대H100칩보다5배의처리량을제공하며,Signal65가"엘리트AI성능"이라고부른것이이제접근가능한유틸리티로제공됨을보여줍니다.​Microsoft의이혁신은회사가대규모AI인프라투자를가속화하는시기에나왔습니다.이기술대기업은월요일에세건의별도수십억달러규모AI거래를발표했으며,여기에는추가NVIDIAGB300용량을위한IRENLimited와의97억달러규모파트너십과수만개의GPU배포를위한Lambda와의별도계약이포함됩니다.​AI군비경쟁에서의인프라리더십이기록적인성능은이전세대대비50%더많은메모리와16%높은열용량을포함한향상된사양을갖춘72개의GPU를탑재한단일NVIDIAGB300NVL72랙에걸쳐18개의가상머신을사용하여달성되었습니다.이시스템은가상머신당초당평균61,163개의토큰처리량으로놀라운일관성을보여주었습니다.​"이성능이정표는NVIDIA와의지속적인협력을보여주며프로덕션환경에서광범위한AI워크로드를관리하는Azure의능력을강조합니다"라고MicrosoftCEO사티아나델라는말하며,이성과가Azure를엔터프라이즈AI추론을위한최고의플랫폼으로자리매김하게한다고강조했습니다.이이정표는단순한기술적성과이상을의미합니다.산업규모의AI처리가클라우드에도입되었음을알리며,대규모내부인프라투자없이도주류기업들이정교한AI기능에접근할수있게되었습니다.
252 조회
0 추천
11.05 등록
(퍼플렉시티가정리한기사)Anyscale과Microsoft는오늘Azure에서새로운AI네이티브컴퓨팅서비스를출시하기위한파트너십을발표했으며,즉시비공개프리뷰에진입하고Ray의분산컴퓨팅기능을엔터프라이즈규모의클라우드서비스로대폭확장하는계기가되었습니다.​완전관리형퍼스트파티Azure서비스는Anyscale이만든오픈소스분산컴퓨팅프레임워크인Ray를기반으로하며,기업들이AI워크로드를확장할때레거시컴퓨팅시스템으로직면하는한계를해결합니다.이서비스는코드변경없이도자체관리형Ray에비해최대10배빠른성능을제공합니다.​엔터프라이즈급AI컴퓨팅솔루션"AI는모든산업을재정의하고있지만,이를확장하는것은여전히가장어려운과제중하나입니다"라고Anyscale의CEO인KeertiMelkote는말했습니다."Microsoft와함께,우리는기업들이대규모로AI를구축하고실행하는것을획기적으로더쉽게만들고있습니다—Ray를위해특별히제작된Anyscale의플랫폼과Azure의신뢰할수있는인프라를결합하여기업들이인프라관리가아닌혁신에집중할수있도록합니다".​새로운서비스는AzureKubernetesService(AKS)에서직접실행되며,AzurePortal을통한간소화된클러스터배포,대화형개발환경,그리고배치처리와저지연서빙모두를위한장애허용Ray클러스터를기업에제공합니다.Azure고객들은통합청구의혜택을받을수있으며,기존MicrosoftAzureConsumptionCommitments를이서비스에적용할수있습니다.​Ray의성장하는엔터프라이즈도입Ray는월간2,700만건이상의다운로드와39,000개의GitHub스타를기록하며AI인프라의핵심기술로부상했습니다.Uber,Spotify,Canva,Coinbase를포함한주요기업들이이미분산AI컴퓨팅을위해Ray를활용하고있습니다.이프레임워크는단일파이프라인에서CPU와GPU와같은특수가속기전반에걸쳐데이터처리,모델학습및추론을통합함으로써현대AI의복잡성을해결합니다.​Microsoft의클라우드네이티브컴퓨팅담당CorporateVicePresident이자Kubernetes공동창시자인BrendanBurns는"기업들은AI워크로드를확장할때유연성과제어권을원합니다"라고말했습니다."Azure의Anyscale을통해Ray를AzureKubernetesService에도입함으로써,우리는개발자들에게익숙한클라우드네이티브패턴을사용하여AI애플리케이션을구축하고확장할수있는능력을제공하고있습니다".​이서비스는AzurePortal을통해비공개프리뷰로유지되며,2026년에정식출시될예정입니다.
253 조회
0 추천
11.05 등록
(퍼플렉시티가정리한기사)Google는화요일에가장야심찬문샷프로젝트를발표했습니다:프로젝트선캐처(ProjectSuncatcher)는회사의인공지능칩을탑재한위성네트워크를사용하여우주에태양광발전데이터센터를구축하는연구이니셔티브입니다.이거대기술기업은지구대기권밖에서머신러닝확장가능성을테스트하기위해PlanetLabs와협력하여2027년초까지두개의프로토타입위성을발사할계획입니다.​이프로젝트는컴퓨팅수요가급증함에따라AI개발이직면한에너지제약문제를해결합니다."우리의TPU가우주로향합니다!"GoogleCEO순다르피차이(SundarPichai)는이이니셔티브를발표하며말했습니다."양자컴퓨팅에서자율주행에이르기까지우리의문샷역사에서영감을받아,프로젝트선캐처는언젠가우주에서확장가능한ML컴퓨팅시스템을구축하여태양의더많은에너지를활용할수있는방법을탐구하고있습니다".​AI인프라에대한혁신적인접근방식Google의시스템은태양광패널이지상설치보다최대8배많은전력을생성할수있고거의지속적인햇빛을받을수있는새벽-황혼태양동기저궤도에서위성군집에텐서처리장치(TPU)를배치할예정입니다.위성들은Starlink와같은기존군집보다훨씬가깝게수백미터간격으로배치되며,초당1.6테라비트를달성하는자유공간광학링크를통해연결될것입니다.​이프로젝트를이끄는Google의지능패러다임선임이사TravisBeals는"AI사용이계속증가하고이를구동하기위해더많은에너지를원하는방향으로계속진행된다면,이것은확장할수있는엄청난잠재력을가지고있습니다"라고말했습니다.회사의분석에따르면발사비용이2035년까지킬로그램당약200달러로떨어질수있으며,이는우주기반데이터센터를킬로와트당기준으로지상시설과경제적으로비교가능하게만들것입니다.​테스트및기술적과제Google은이미최신Trillium세대TPU에대해입자가속기를사용하여수년간의우주노출을시뮬레이션하는유망한방사선테스트를수행했습니다.이칩들은예상되는5년임무선량의최대15배까지손상없이견뎌냈으며,이는우주응용분야에서놀라운방사선내성을나타냅니다.Beals는"칩들이상당히잘버텼습니다"라고언급하며,프로세서가5~6년임무를쉽게처리할수있을것이라고시사했습니다.​그러나진공상태에서의열관리,고대역폭지상통신,그리고서로수킬로미터이내에서위성편대를유지하는것등상당한공학적과제가남아있습니다.이는현재의우주기술을훨씬뛰어넘는정밀도를요구합니다.Planet과의2027년프로토타입임무는이러한핵심시스템들을테스트하고위성네트워크전반에걸친분산머신러닝워크로드를검증할것입니다.
247 조회
0 추천
11.05 등록
(퍼플렉시티가정리한기사)SAP와Snowflake는오늘데이터플랫폼통합을위한전략적파트너십을발표했으며,이를통해기업들은데이터중복없이의미론적으로풍부한비즈니스데이터를사용하여AI애플리케이션을구축할수있게되었습니다.베를린에서열린SAP의TechEd2025행사에서공개된이번협력은Snowflake의AIDataCloud와SAP의BusinessDataCloud간에제로카피데이터공유시스템을구축합니다.​새로운"SAPSnowflakesolutionextensionforSAPBusinessDataCloud"는조직이정보를이동하거나중복하지않고두플랫폼에서실시간으로데이터에액세스하고분석할수있도록합니다.정식출시는2026년1분기로예정되어있으며,SAPBusinessDataCloudConnectforSnowflake는2026년상반기에출시될예정입니다.​기업AI과제해결이파트너십은기업AI프로젝트의핵심병목현상을목표로합니다:데이터분석에적절한비즈니스맥락을제공하는것입니다."AI를사용할때는데이터의올바른맥락을제공하는것을피할수없습니다.이것은매우어렵고비용이많이드는일이었습니다"라고SAP데이터및분석부문의최고마케팅책임자인DanielYu는SiliconANGLE과의인터뷰에서말했습니다.​Snowflake의제품담당수석부사장인ChristianKleinerman은통합의단순성을강조했습니다:"SAP와Snowflake를긴밀하게통합함으로써,우리는기업들이SAP의풍부한맥락을가진중요한비즈니스데이터를Snowflake에서대규모로원활한AI앱및데이터에이전트개발의힘과연결하는것을간단하게만들고있습니다".​산업채택및확장주요고객들은이미이파트너십을활용하고있으며,여기에는거대제약회사아스트라제네카가포함됩니다.아스트라제네카의ERP혁신기술부사장인러셀스미스는"데이터와AI는이목표달성의핵심이며,SAP및Snowflake와의긴밀한협력은실시간데이터를액세스하고,처리하고,분석할수있는우리의역량을보완합니다"라고말했습니다.​Snowflake통합은이미Databricks및GoogleCloud와의파트너십을포함하고있는SAP의데이터생태계전략을확장합니다.SAP데이터및애널리틱스사장겸최고제품책임자인이르판칸은이번협력이"고객에게개방성과선택권을부여"하는동시에"전체생태계에걸쳐비즈니스데이터의가치를확장"한다고말했습니다.
261 조회
0 추천
11.05 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입