Grok 4.7 출시 — 코딩·업무 모델, 무엇을 확인해야 하나

Grok 4.7의 제공 경로와 API 가격, 회사 발표의 성능 수치를 실무에서 어떻게 읽어야 하는지 정리했습니다.

xAI가 2026년 9월 21일 Grok 4.7을 공개했습니다. 회사는 코딩과 지식 업무, 긴 작업의 자체 검증 능력을 강조합니다. 이용자는 ‘어느 모델이 1등인가’라는 순위보다, 지금 이용 가능한 경로와 실제 작업 한 건의 비용·품질이 어떻게 달라지는지를 살펴볼 필요가 있습니다.

이번 발표의 핵심

xAI는 Grok 4.7이 Grok 4.6보다 더 큰 기반 모델을 사용하고, 오래 걸리는 어려운 과제에 맞춘 학습을 거쳤다고 설명합니다. 코드 수정처럼 여러 단계를 이어가는 일에서 스스로 결과를 확인하는 능력을 개선했다는 것이 회사의 주장입니다. 문서·발표 자료 작성과 일반적인 지식 업무도 적용 대상으로 제시했습니다.

공개 자료에는 코딩·사무 업무·안전성 벤치마크가 포함돼 있습니다. 하지만 이는 발표사가 선택한 시험 환경에서의 수치입니다. 다른 업체 모델과 숫자만 나란히 놓고 모든 실무에서 우수하다고 결론 내릴 수는 없습니다.

어디서 사용할 수 있나요?

발표 시점에 확인된 제공 경로는 Cursor, Grok Build, Grok API 및 일부 외부 개발 도구·클라우드 플랫폼입니다. 이 발표만으로 일반 Grok 웹·모바일 앱의 모든 계정에 Grok 4.7 선택지가 표시된다고 볼 수는 없습니다. 이용하려는 서비스의 모델 목록에서 실제 제공 여부를 확인해야 합니다.

API 비용은?

xAI가 발표한 시작 가격은 입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러입니다. 출력 속도가 약 두 배인 별도 빠른 변형은 가격도 두 배라고 안내합니다. 이는 API 단가이며, Cursor 같은 외부 서비스의 구독료나 크레딧 정책과 같지 않습니다. 실제 비용에는 입력 길이, 출력량, 도구 호출과 재시도도 영향을 줍니다.

어떻게 비교하면 좋을까요?

Infosence가 권하는 방법은 동일한 과제를 Grok 4.7과 현재 쓰는 모델에 각각 맡기는 것입니다. 예를 들어 버그 수정이라면 테스트 통과 여부, 불필요하게 바꾼 파일 수, 추가 지시 횟수, 완료 시간, 총 사용량을 기록합니다. 보고서라면 수치의 출처와 누락된 반론까지 검토합니다. 단일 벤치마크 점수보다 내 업무에서의 재작업 여부가 모델 선택에 더 유용할 수 있습니다.

아직 단정할 수 없는 것

  • 회사 발표의 가격 대비 성능 비교가 모든 작업·설정에서 재현되는지는 별도 시험이 필요합니다.
  • 모든 Grok 계정과 모든 외부 앱에서 같은 날 모델을 선택할 수 있는 것은 아닙니다.
  • 안전성 관련 수치 역시 특정 평가에서 얻은 결과이지, 실제 사용에서 오류나 위험이 없다는 보장은 아닙니다.

확인 기준: 2026년 9월 24일. 출시일, 제공 경로, 가격과 성능 관련 발표는 xAI 공식 발표를 기준으로 정리했습니다. 비교 방법과 활용 제안은 Infosence의 해석입니다.