xAI, 비용 98% 절감한 Grok 4 Fast 출시

xtalfi

2025.09.21 13:33

2,917

(퍼플렉시티가 정리한 기사)

일론 머스크의 xAI는 2025년 9월 19일에 Grok 4 Fast를 공개하며, 인공지능 모델을 비용 효율적인 추론 기술의 혁신으로 자리매김했습니다. 이 모델은 최대 200만 토큰의 컨텍스트 윈도우를 제공하며, 이전 모델보다 40% 적은 토큰을 사용하면서도 유사한 수준의 성능을 유지합니다.

새로운 모델은 추론 및 비추론 기능을 하나의 프레임워크에 통합한 통합 아키텍처를 제시하며, 개발자들이 정확도를 희생하지 않고 연산 노력을 조절할 수 있도록 합니다. xAI의 내부 테스트에 따르면 Grok 4 Fast는 Grok 4와 동일한 벤치마크 성능을 달성할 때 비용을 98%까지 줄이는 것으로 나타났습니다.

경쟁 테스트에서 뛰어난 성능

Grok 4 Fast는 여러 평가 플랫폼에서 인상적인 결과를 보여주었습니다. 코드네임 "Menlo"로 운영되는 이 모델은 LMArena의 Search Arena에서 Elo 점수 1,163으로 1위를 차지하며, 가장 가까운 경쟁자인 o3-search를 17점 차이로 앞섰습니다. 또한 Text Arena에서는 8위를 기록하여, 더 큰 모델들과 비교했을 때 지능 밀도를 과시했습니다.

Artificial Analysis의 독립적인 분석에서 Grok 4 Fast는 경쟁력 있는 위치를 확인받았으며, GPT-5, Gemini 2.5 Pro, Claude 4.1 Opus 등과 함께 순위에 오르는 동시에 Grok 4에 비해 약 47배 낮은 비용으로 운영되는 것으로 평가되었습니다. 이 모델은 AIME 2025에서 92%, HMMT 2025에서 93.3%, GPQA Diamond에서는 85.7% 등 의미 있는 벤치마크 점수를 달성했습니다.

고급 교육 및 도구 통합

이 모델은 코드 실행과 웹 브라우징 기능을 포함하여 도구 사용에 대한 자율적 의사 결정을 가능하게 하는 종단 간 강화 학습 훈련을 통합하고 있습니다. 이러한 훈련 방식은 Grok 4 Fast가 X의 멀티미디어 콘텐츠를 분석하고 실시간 정보를 효율적으로 종합할 수 있게 해줍니다.

xAI는 두 가지 구별되는 변형을 제공합니다: grok-4-fast-reasoning과 grok-4-fast-non-reasoning이며, 두 가지 모두 2백만 토큰 컨텍스트 창을 지원합니다. 이 모델은 초당 296.8 토큰의 속도로 작동하며 최초 토큰 생성까지 2.57초가 걸려, 동급 평균 모델에 비해 더 빠른 성능을 제공합니다.

접근성 및 가격 구조

Grok 4 Fast는 모든 사용자에게 grok.com, iOS, Android 애플리케이션의 Fast 및 Auto 모드를 통해 즉시 제공됩니다. 한정된 기간 동안, 이 모델은 OpenRouter와 Vercel AI Gateway 플랫폼을 통해 무료로 제공됩니다.

xAI API의 요금 구조는 128,000 토큰 미만의 요청에 대해 백만 입력 토큰당 $0.20에서 시작하며, 더 큰 요청의 경우 백만 당 $0.40까지 올라갑니다. 출력 토큰의 경우, 소규모 요청은 백만 당 $0.50이고, 대규모 사용 시 백만 당 $1.00입니다. 캐시된 입력 토큰은 백만 당 $0.05로 책정되어 있습니다.