스페이스엑스에이아이(SpaceXAI)는 그록(Grok) 4.7을 출시했습니다. 독립 점검 결과, 이 모델은 최첨단 AI 랩 중 네 번째를 차지했습니다.
독립 벤치마크 기관인 아티피셜 애널리시스(Artificial Analysis)가 이 모델에 인텔리전스 인덱스 46점을 부여했습니다. 이는 그록 4.6보다 2점 높은 수치입니다. 클로드 페이블 5.1, GPT-6 아스트라, 클로드 오퍼스 5가 더 높은 순위를 기록했습니다.
그록 4.7, 스페이스엑스에이아이를 상위 4개 AI 연구소로 끌어올립니다
일론 머스크는 출시 전에 “이 모델은 2.1조(트릴리언) 파라미터 기반에서 구동되며 모든 기존 모델을 뛰어넘을 것이다”라고 말했습니다. 그는 “모델 학습에는 스페이스엑스 회사 데이터가 포함됐다”고 밝혔습니다.
X에서 저희를 팔로우하시고 실시간 최신 뉴스를 받아보세요
그록 4.7의 실제 성능은 어떻습니까? 아티피셜 애널리시스 직업 실무 특화 벤치마크 AA-브리프케이스에서 그록 4.7은 1657 Elo를 기록했습니다. 이는 그록 4.6보다 111점 높으며, 모델 수준이 클로드 오퍼스 5에 근접했습니다.
GDPval-AA 기준으로 1695 Elo를 달성하여 전작보다 90점 높았습니다. 코딩 결과 또한 같은 방향으로 움직였습니다.
자체 코딩 에이전트인 Grok Build와 짝을 이룬 상태에서, 그록 4.7은 코딩 에이전트 인덱스 56점을 기록했습니다. 이는 그록 4.6보다 9점 높습니다.
이 모델은 GPT-5.6 솔을 제쳤으며, 현재는 앤스로픽(Anthropic)의 클로드 페이블 5.1, GPT-6 아스트라, 오퍼스 5만 뒤따르고 있습니다.
“그록 4.7은 아티피셜 애널리시스 인텔리전스 인덱스에서 46점을 기록하여 스페이스엑스에이아이(SpaceXAI)를 상위 4위 AI 랩으로 끌어올렸습니다. 코딩 에이전트 인덱스 성능도 향상되어 GPT-5.6 솔을 앞질렀습니다.” – 해당 게시글
다른 지표에서는 큰 변화가 없었습니다. 터미널-벤치 4.0에서 4.5%포인트, GDP.pdf에서 3점 올랐습니다. 그러나 AA-LCR 및 오토메이션벤치-AA에서는 점수가 하락했습니다. 지난 7월 그록 4.5가 오토메이션벤치를 제패하며 머스크의 “클로드 오퍼스와 대등하다”는 주장을 뒷받침한 바 있습니다.
이 성과는 토큰 비용을 수반합니다
가격표는 변하지 않았습니다. 그록 4.7의 입력 100만 토큰당 비용은 2달러, 출력 100만 토큰당 요금은 6달러입니다. 캐시 적중 시 0.50달러로 할인 적용되며, 50만 토큰 컨텍스트 윈도우도 그록 4.6에서 이어집니다.
하지만 모델은 응답마다 훨씬 많은 작업을 수행합니다. 아티피셜 애널리시스 측정에 따르면 인덱스 작업당 약 8만 1,000개 출력 토큰이 사용되었습니다. 그록 4.6은 3만 6,000개, GPT-6 아스트라는 2만 7,000개였습니다. 그러므로 단가가 같아도 작업당 청구 비용이 더 높아집니다.
이 같은 토큰 사용량은 이미 12억 6,000만 달러 손실을 보고한 부서에 영향을 줍니다. 한편, 머스크는 9월 14일 “그록 4.8의 학습이 일주일 내 완료될 것”이라고 밝혔습니다.
그는 또한 그록 5가 인공지능 일반지능(AGI)에 도달하는 모델이 될 것으로 기대한다고 밝혔습니다. 다음 버전에서는 추가 컴퓨트 소모 없이 스페이스엑스에이아이가 순위를 더 높일 수 있을지 시험하게 됩니다.









