Loading...

AI 뉴스

중국 스타트업, 오픈소스 AI가 GPT-5를 능가한다고 주장

페이지 정보

작성자 xtalfi
작성일 2025.11.08 14:59
1,595 조회
0 추천
0 비추천

본문

f43ee9a7735c9322763d602776200742_1762581565_2634.jpg
 

(퍼플렉시티가 정리한 기사)


중국 스타트업 Moonshot AI는 목요일 Kimi K2 Thinking 모델을 출시하며, 1조 개의 매개변수를 가진 이 오픈소스 시스템이 추론, 코딩 및 자율 에이전트 작업에 대한 여러 벤치마크에서 OpenAI의 GPT-5, Anthropic의 Claude Sonnet 4.5, 그리고 이전 오픈소스 선두주자인 MiniMax-M2를 능가한다고 주장했다.​

이번 출시는 Nvidia CEO Jensen Huang이 중국이 "AI에서 미국보다 나노초 뒤처져 있다"고 경고하며 미국의 개발 가속화 필요성을 강조한 시점에 이루어졌다. 이 타이밍은 OpenAI CFO Sarah Friar가 미국 정부가 1.4조 달러를 초과하는 AI 인프라 투자에 대해 "안전망"을 제공해야 한다고 제안한 발언으로 인한 최근 논란을 고려할 때 특히 주목할 만하다—이 발언은 그녀와 CEO Sam Altman이 신속히 철회했다.​


벤치마크 성능이 독점 모델에 도전하다

Kimi K2 Thinking은 AI가 발전함에 따라 계속 도전적으로 유지되도록 설계된 2,500개의 전문가 검증 질문으로 구성된 최전선 수준의 벤치마크인 Humanity's Last Exam에서 44.9%를 달성했습니다. 이 모델은 GPT-5가 54.9%를 기록하고 Claude Sonnet 4.5가 24.1%에 도달한 웹 연구 벤치마크인 BrowseComp에서 60.2%를 기록했습니다. 실제 소프트웨어 엔지니어링 문제 해결을 테스트하는 SWE-Bench Verified에서 K2 Thinking은 71.3%를 기록했습니다.​

제3자 평가 기관인 Artificial Analysis에 따르면, K2 Thinking은 도구 사용이 필요한 고객 서비스 시나리오에서 AI 성능을 측정하는 Tau2 Bench Telecom 에이전트 벤치마크에서 최고 점수를 달성했습니다. 이 모델은 인간의 개입 없이 수백 단계에 걸쳐 일관된 추론을 유지하면서 200-300개의 순차적 도구 호출을 자율적으로 실행할 수 있습니다.​


독점 시스템 대비 비용 우위

Moonshot AI는 K2 Thinking의 API 가격을 캐시된 입력의 경우 백만 토큰당 $0.15, 캐시 미스의 경우 백만 토큰당 $0.60, 출력의 경우 백만 토큰당 $2.50로 책정했습니다. 이는 GPT-5의 백만 입력 토큰당 $1.25, 백만 출력 토큰당 $10의 가격과 비교됩니다. Claude Sonnet 4.5는 백만 입력 토큰당 $3, 백만 출력 토큰당 $15입니다.​

CNBC가 인용한 소식통에 따르면 훈련 비용은 총 460만 달러로 보고되었습니다. 이는 OpenAI와 다른 미국 기업들이 모델 개발에 지출한 수십억 달러와 대조를 이룹니다.​


수정된 MIT 라이선스 하의 오픈 액세스

이 모델은 Hugging Face에서 수정된 MIT 라이선스로 제공되며, 한 가지 조건과 함께 완전한 상업적 및 파생 권리를 제공합니다: 월간 활성 사용자 100만 명을 초과하거나 월 2천만 달러 이상의 수익을 창출하는 제품은 사용자 인터페이스에 "Kimi K2"를 눈에 띄게 표시해야 합니다. 개발자들은 Moonshot의 플랫폼인 platform.moonshot.ai와 kimi.com을 통해 모델에 접근할 수 있습니다.​

이번 출시는 중국 기업들이 오픈소스 AI를 배포하여 서구의 독점 시스템에 도전하는 패턴을 확장합니다. Airbnb CEO 브라이언 체스키(Brian Chesky)는 최근 자신의 회사가 AI 고객 서비스를 위해 Alibaba의 Qwen 모델에 "크게 의존"하고 있으며, ChatGPT에 비해 "매우 좋고" "또한 빠르고 저렴하다"고 칭찬했습니다.​

2023년에 설립되고 Alibaba와 Tencent의 지원을 받는 Moonshot AI는 2024년 2월에 25억 달러 기업 가치로 10억 달러를 조달했고, 2024년 8월에는 추가로 3억 달러를 조달했습니다.

댓글 0
전체 1,366 / 49 페이지
• OpenAI는 ChatGPT 내에서 광고를 내부적으로 테스트하고 있으며, Android 앱 베타 버전에서 “search ad” 및 “search ads carousel”에 대한 코드 참조가 발견되어 초기에는 검색 경험으로 광고를 제한할 것으로 보입니다.[bleepingcomputer +2]• 이 회사는 2025년 말까지 연간 반복 수익 200억 달러를 달성할 궤도에 있지만, 올해 80억 달러를 소진하고 2029년까지 1,150억 달러의 손실이 예상되며 8년에 걸쳐 1.4조 달러의 컴퓨팅 지출을 약속하면서 재정적 압박이 커지고 있습니다.[observer +2]• 광고 테스트는 ChatGPT가 매일 약 5천만 건의 쇼핑 쿼리를 처리하는 가운데 OpenAI가 11월에 Shopping Research 기능을 출시한 것에 따른 것이며, CEO Sam Altman은 구독 및 엔터프라이즈 솔루션을 넘어 수익을 다각화하기 위해 회사가 “언젠가 광고를 시도할 것”이라고 인정했습니다.[digitalcommerce360 +2]
700 조회
0 추천
2025.11.30 등록
Palantir [ +1.89%] 주가는 11월에 17% 급락하여 2023년 8월 이후 최악의 월간 하락률을 기록했습니다. 이는 투자자들이 밸류에이션 우려와 공매도 투자자 마이클 버리가 회사에 대한 9억 달러 규모의 공매도 포지션을 공개한 후 AI 관련 주식에서 손을 뗐기 때문입니다.[cryptorank]이번 매도는 월스트리트 예상을 상회하는 11억 8천만 달러의 매출로 강력한 3분기 실적을 기록했음에도 불구하고 발생했습니다. Jefferies, RBC Capital Markets, Deutsche Bank를 포함한 여러 애널리스트들이 회사의 선행 주가수익비율(forward earnings)이 약 233배로 Nvidia [ -2.08%]의 38배와 비교해 “극단적인” 밸류에이션이라고 지적했습니다.[cryptorank]CEO 알렉스 카프는 버리를 시장 조작으로 비난하고 공매도 포지션을 “완전히 미친 짓”이라고 부르며 회사를 방어했습니다. 한편 광범위한 AI 섹터 후퇴로 Nvidia는 12% 이상 하락했고, Microsoft [ +1.34%]와 Amazon [ +1.75%]은 약 5% 하락했으며, Apple [ +0.29%]과 Alphabet만이 11월에 상승세를 기록했습니다.[cryptorank]
717 조회
0 추천
2025.11.30 등록
2025년스마트워치산업은웨어러블기기를단순한피트니스트래커에서만성질환의조기경고신호를감지할수있는임상등급센서와인공지능을갖춘정교한건강모니터링시스템으로변모시켰습니다.삼성,애플,Garmin의최신세대기기들은이제수면의질부터심혈관부담까지모든것을추적할수있는고급바이오센서를탑재하여손목에서예방적헬스케어로의전환을보여주고있습니다.임상급모니터링이소비자기기에도달하다2025년7월출시된삼성의GalaxyWatch8시리즈는일주기리듬을분석하여최적의수면시간을권장하는취침가이드(BedtimeGuidance)와수면중심혈관부담을측정하는혈관부하(VascularLoad)추적을포함한여러건강혁신기능을도입했습니다.이기기들은또한5초만에카로티노이드수치를평가하여산화스트레스와전반적인웰빙에대한통찰력을제공하는항산화지수(AntioxidantIndex)기능을탑재하고있습니다.​애플은2025년9월WatchSeries11의고혈압감지기능에대해FDA승인을받았으며,이기능은광학센서를사용하여30일동안심장박동에대한혈관의반응을분석합니다.이알고리즘은만성고혈압과관련된일관된패턴을수동적으로모니터링하며,애플에따르면이전에진단받지못한100만건이상의사례를잠재적으로식별할수있습니다.Series11은또한24시간배터리수명과AppleIntelligence로구동되는수면점수기능을제공합니다.​가민의2025년11월소프트웨어업데이트는수십개의워치모델에건강상태(HealthStatus)기능을도입했으며,이는안정시심박수,심박수변이도,맥박산소측정,호흡,피부온도를분석하여개인화된건강기준선을생성합니다.이시스템은지표가정상범위를벗어나는경향을보일때사용자에게알림을보내며,이는질병,과훈련또는스트레스를나타낼수있습니다.​AI통합확대로시장급등글로벌스마트워치시장은2025년1,083억1,000만달러에달할것으로예상되며,연평균12.9%의성장률을기록할것으로전망됩니다.고급건강모니터링기능이도입을촉진하고있으며,웰니스애플리케이션이시장점유율의35%이상을차지하고있습니다.북미는건강중심웨어러블의조기도입과확장된무선인프라에힘입어전세계성장의40%를차지합니다.​이러한기기들은이제여러데이터스트림을동시에처리하는AI기반분석을통합하여,개인화된웰니스점수와불규칙한심장리듬,탈수위험및수면장애에대한예측알림을제공합니다.삼성의갤럭시워치8은구글제미나이통합을특징으로하는최초의스마트워치가되어,음성제어건강추적및운동관리를가능하게했습니다.
743 조회
0 추천
2025.11.29 등록
중국AI스타트업DeepSeek은목요일오픈소스수학적추론모델인DeepSeekMath-V2를공개했으며,이모델은2024년Putnam수학경시대회에서120점만점에118점이라는거의완벽한점수를달성하여인간최고점수인90점을능가했다.6,850억개의매개변수를가진이모델은또한InternationalMathematicalOlympiad2025와ChineseMathematicalOlympiad2024에서금메달수준의성능을달성했다.​DeepSeekMath-V2가IMO수준경시대회에서금메달등급을달성한최초의오픈소스모델이되면서,이번출시는AI기반수학적추론의전환점을나타낸다.올해초유사한이정표를달성한OpenAI와GoogleDeepMind의독점모델들과달리,DeepSeek은HuggingFace와GitHub에서Apache2.0라이선스로모델가중치를공개적으로제공했다.​자기검증프레임워크가AI추론격차를해결하다이모델은최종답변의정확성보다증명의질을우선시하는새로운자기검증프레임워크를도입합니다.DeepSeek연구진은한시스템이수학적증명을생성하는"증명자"역할을하고다른시스템이추론을면밀히검토하는"검토자"역할을하는이중모델아키텍처를설계했습니다.회사의기술논문에따르면,이접근방식은현재AI시스템의중요한한계를해결합니다:"올바른최종답변이올바른추론과정을보장하지는않는다".​그룹상대정책최적화(GroupRelativePolicyOptimization)를기반으로구축된훈련방법론은단순히정답에보상을주는대신증명이완전하고논리적으로건전한지를평가하는검증자우선접근방식을사용합니다.IMO-ProofBench벤치마크에서DeepSeekMath-V2는기본증명에대해99%의성공률을달성하여Google의GeminiDeepThink의89%를크게능가했습니다.​중국,오픈소스AI에서우위확보이번출시는중국이글로벌오픈소스AI시장에서미국을추월하면서이루어졌습니다.11월말MIT와HuggingFace가발표한연구에따르면,중국에서개발된오픈모델은지난1년간전세계다운로드의17%를차지하여처음으로미국개발자들의15.8%점유율을넘어섰습니다.DeepSeek와Alibaba의Qwen모델이중국의오픈모델다운로드를주도하고있습니다.
734 조회
0 추천
2025.11.29 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입