YouTube코드팩토리·2026년 9월 22일·0

Grok 4.7 출시! 드디어 다시 3사 경쟁!

Quick Summary

Grok 4.7은 가격 대비 성능과 코딩 개선으로 다시 3사 경쟁을 기대하게 하지만, 이번 리뷰에서는 디자인·한국어 창작보다 자동화와 보조 작업에 더 적합한 모델로 평가된다.

영상 보기

클릭 전까지는 가벼운 미리보기만 먼저 불러옵니다.

원본 열기

🖼️ 인포그래픽

Grok 4.7 출시! 드디어 다시 3사 경쟁! 내용을 설명하는 본문 이미지

🖼️ 4컷 인포그래픽

Grok 4.7 출시! 드디어 다시 3사 경쟁!의 핵심 내용을 4단계로 요약한 인포그래픽
Grok 4.7 출시! 드디어 다시 3사 경쟁! 핵심 내용을 4단계로 압축한 4컷 인포그래픽

💡 한 줄 결론

Grok 4.7은 가격 대비 성능과 코딩 개선으로 다시 3사 경쟁을 기대하게 하지만, 이번 리뷰에서는 디자인·한국어 창작보다 자동화와 보조 작업에 더 적합한 모델로 평가된다.

📌 핵심 요점

  1. 출시의 의미는 경쟁 선택지 확대다. 발표자는 Grok이 실사용 가능한 수준으로 올라오면서 OpenAI·앤트로픽 중심의 경쟁에 새로운 선택지가 생겼다고 평가한다. 이는 영상의 시장 해석이며, 독립적으로 검증한 시장 순위는 아니다.
  2. 속도와 비용이 주요 강점으로 제시된다. 공식 설명은 유사 모델 대비 두 배의 속도와 절반의 가격을 주장한다. 영상에 소개된 커서 벤치에서는 비슷한 성능 설정의 비용이 11.43달러와 약 6.01달러로 비교되지만, 발표자의 체감은 ‘조금 더 빠르다’는 수준이다.
  3. 게임 제작에서는 쓸 만한 초안을 만들었다. 마인크래프트형 결과물은 지형·블록 조작을, GTA형 결과물은 차량 탑승·주행 등을 구현했다. 다만 인벤토리, 전투, 미션 같은 기능이 빠지고 조작 방향 오류도 있어 후속 수정이 필요했다.
  4. 디자인과 한국어 글쓰기는 아쉬움이 남았다. 자기소개 웹사이트는 여백과 구성, 창의성에서 낮은 평가를 받았다. 한국어 소설도 읽기 편하지 않고 결과의 일관성이 부족하다는 평가였으며, 발표자는 해당 용도로 GPT 계열을 선호했다.
  5. 구독 상황에 따라 활용법이 달라진다. Grok만 지원받는 환경이라면 메인 모델로 사용할 만하지만, 다른 상위 모델도 구독한다면 자동화·오케스트레이션·테스트·QA를 맡겨 사용량을 분산하는 방식이 제안된다.

🧩 배경과 문제 정의

이 영상은 Grok 4.7 출시를 계기로, Grok이 다시 주요 AI 모델 경쟁의 실질적인 선택지가 될 수 있는지 살펴보는 리뷰다. 발표자는 가격 유지와 어려운 작업의 성능 개선이라는 출시 메시지를 소개한 뒤, 벤치마크와 직접 만든 결과물을 함께 검토한다.

핵심 문제는 ‘최고 성능인가’에만 있지 않다. 기존 모델 대비 비용과 속도가 어떤지, 게임·웹사이트·한국어 소설에서 어느 정도 완성도를 내는지, 이미 여러 모델을 구독하는 이용자에게 어떤 역할을 맡길 만한지가 평가의 중심이다. 아래 내용은 제공된 전사에 나온 주장과 발표자의 관찰을 구분해 정리했다.

🕒 시간순 섹션별 상세정리

1. 출시 메시지와 비교 실험의 구성

  • Grok 4.7은 가격을 유지하면서 어려운 작업을 더 잘한다는 설명으로 묶인다. 일론 머스크의 평가는 오퍼스 5.0과 비슷하되 작업에 따라 앞서거나 뒤처진다는 내용으로 전달된다. [00:18]
  • 후속 버전이 오퍼스와 아스트라·페이블을 넘어설 수 있다는 전망을 소개하지만, 이는 향후 성능에 대한 기대다. 발표자는 큰 폭의 추월이 메이저 업데이트까지는 어렵다는 의미로 해석한다. [00:42]
  • 직접 비교할 과제로 GTA형 게임, 마인크래프트형 게임, 한국어 소설, Grok 자기소개 웹사이트의 네 가지를 제시한다. [01:02]

2. 공식 벤치마크와 경쟁 구도 해석

  • 공식 설명은 유사 모델보다 두 배 빠르고 가격은 절반이라고 주장한다. 발표자는 오퍼스보다 조금 빠르게 느꼈다고 말하며, 커서 벤치의 유사 성능 설정에서 11.43달러와 약 6.01달러라는 비용 비교를 보여준다. [02:00]
  • 토큰 사용량과 성능 분포를 보며 오퍼스를 겨냥한 모델이라고 해석한다. 이어 OpenAI·앤트로픽 중심의 경쟁에 Grok이 가세하는 것이 이용자에게 유익하다고 평가한다. [03:03]
  • 데이터센터가 속도와 안정성에 도움을 줄 것이라는 기대를 덧붙이고, SW 벤치와 터미널 벤치에서는 솔과 비슷한 수준으로 보여준다. 출시 표현이 비교적 절제됐다는 평가는 발표자의 인상이다. [03:39]

3. 엇갈리는 사용 평가와 마인크래프트 시연

  • 이전 버전보다 좋아졌다는 의견과 오히려 아쉽다는 의견을 함께 보여준다. 발표자는 속도·코딩의 개선을 느꼈지만 아스트라·페이블과 비교하면 부족하며, 라우팅·테스트·QA 같은 용도에 적합하다고 본다. [04:48]
  • 마인크래프트형 결과물은 블록 제거·설치와 숫자 키·스크롤 휠을 통한 선택을 구현했다. 다만 블록이 한 번에 깨지고 완전한 인벤토리는 없으며, 발표자는 Fast X하이 설정에서 한 번의 지시로 만든 결과라고 보여준다. [05:44]
  • 해변·물·나무 등 환경 요소는 갖춰졌다. 완성된 게임이라기보다 추가 지시로 개선해 실제 제작을 이어갈 수 있는 출발점으로 평가한다. [06:20]

4. GTA형 게임과 웹사이트의 완성도

  • GTA형 결과물에는 인물과 차량, 탑승·주행·충돌에 따른 반응이 구현됐다. 그러나 전투와 미션, 건물 진입이 빠졌고 좌우 조작이 반전되는 문제도 보여, 분위기 구현과 기능 완성도 사이에 차이가 있었다. [07:20]
  • 자기소개 웹사이트는 넓은 빈 공간과 단순한 등장 애니메이션, 어색한 사이드바 구성이 지적된다. 이동 기능은 작동하지만 발표자는 창의성과 미적 완성도에 낮은 평가를 내린다. [08:22]
  • 디자인 작업에 Grok을 사용해야 한다면 레퍼런스를 충분히 제공하라고 권한다. 코드로 화면을 구현하는 능력은 있다고 보면서도, 이번 원페이지 결과물은 지나치게 길고 구성이 아쉽다고 평가한다. [09:04]

5. 한국어 소설 평가와 자동화 활용 사례

  • 200~300자 분량을 요청한 한국어 소설을 낭독한다. 오래 기다리던 아들과 노인을 소재로 한 결과물이지만, 전사에 인식 오류 가능성이 있어 개별 문장의 정확한 품질 판단에는 주의가 필요하다. [09:53]
  • 발표자는 이번 글이 비교적 잘 나온 편임에도 읽기 어렵다고 평가한다. 한국어 작업에는 GPT 계열을 선호하며, 자신은 여전히 페이블을 주력 모델로 쓴다고 보여준다. [10:34]
  • Grok 구독은 주로 그록봇을 통한 자동화와 오케스트레이션에 활용한다. 두 대의 맥과 테일스케일 네트워크로 다른 컴퓨터에 작업을 넘기는 사용 사례를 보여준다. [11:13]

6. 구독 환경별 권장 용도와 마무리

  • 회사가 Grok만 지원하는 상황이라면 Grok 4.7을 메인 모델로 써도 충분히 괜찮다고 평가한다. 다만 수작업 보완은 더 필요할 수 있다고 덧붙인다. [11:30]
  • OpenAI·앤트로픽 모델을 이미 구독한다면 Grok에 자동화, 오케스트레이션, 테스트 작성과 QA 같은 보조 작업을 맡겨 상위 모델의 사용량을 관리하는 방식을 제안한다. [12:01]
  • 추가 평가 없이 리뷰를 마치고 구독 요청과 다음 영상 인사로 마무리한다. [12:09]

🧾 결론

  • Grok 4.7은 발표자 기준으로 반복 지시와 개선을 통해 실제 결과물을 만들 수 있는 수준에 도달했다.
  • 모든 작업에서 최상위 모델을 대체한다는 결론은 아니다. 게임 초안 제작과 보조 개발 작업의 가능성에 비해 디자인·한국어 창작의 평가는 낮았다.
  • 도입 판단은 벤치마크 점수뿐 아니라 수정에 드는 수작업, 실제 비용, 기존 구독 구성까지 함께 고려해야 한다.

📈 투자·시사 포인트

  • 경쟁 확대: 영상의 관점대로 Grok이 실사용 대안으로 자리 잡는다면, 이용자는 모델 선택과 비용 배분에서 더 많은 선택지를 얻을 수 있다.
  • 비용 경쟁: 유사한 결과를 더 낮은 비용으로 낼 수 있다는 주장은 주목할 만하다. 다만 특정 벤치마크의 비용 차이가 실제 업무에서도 유지되는지가 핵심 확인 사항이다.
  • 업무별 모델 배치: 어려운 작업과 보조 작업을 나눠 맡기는 방식은 상위 모델의 사용량을 관리하는 운영 전략으로 제시된다.
  • 투자 판단의 한계: 영상에는 기업 실적·매출·가치평가 자료가 없다. 제품 경쟁력에 대한 리뷰만으로 특정 기업의 투자 매력을 판단할 근거는 부족하다.

⚠️ 불확실하거나 확인이 필요한 부분

  • ‘두 배 빠르고 반값’은 영상이 소개한 공식 주장이다. 비교 모델, 추론 설정, 과제 구성, 과금 조건이 충분히 제시되지 않아 일반적인 성능·가격 우위로 확장하기 어렵다.
  • 네 가지 시연은 제한된 사례다. 동일 프롬프트의 반복 실행, 성공률, 수정 횟수, 총비용을 비교한 결과는 제공되지 않는다.
  • 전사에는 모델명·버전·금액·소설 문장에 인식 오류로 보이는 표현이 있다. 특히 소설 낭독의 어색한 문장을 모두 모델의 실제 출력 오류로 단정할 수 없다.
  • 자막 기반 정리: 타임스탬프가 있는 자막을 기준으로 정리했으며, 고유명사·수치·인용은 원문 확인 필요 시 별도 검증한다.
  • 영상 속 주장: 발표자의 해석·전망·비교는 확인된 외부 사실이 아니라 영상 속 주장으로 분리해 읽는다.
  • 검증 필요: 수치, 기업 실적, 정책·시장 전망은 발행 전 최신 자료로 별도 검증이 필요하다.

✅ 액션 아이템

  • 자주 하는 코딩·문서·자동화 업무를 같은 프롬프트와 조건으로 비교하고, 성공 여부·응답 시간·총비용·수정 횟수를 기록한다.
  • 게임이나 웹사이트 결과물은 시각적 인상과 별도로 조작 방향, 필수 기능, 링크 이동 등 실제 동작을 확인한다.
  • 디자인 작업에는 원하는 구성과 시각적 레퍼런스를 제공하고, 한국어 결과물은 문장 자연스러움과 의미 전달을 직접 검토한다.
  • 기존 상위 모델의 사용량이 부족하다면 테스트 작성·QA·단순 작업부터 Grok에 배정해 사용량 분산 효과를 확인한다.

❓ 열린 질문

  • 실제 업무에서 재시도와 수작업 수정까지 포함해도 Grok의 비용 이점이 유지되는가?
  • 디자인 레퍼런스와 구체적인 요구사항을 제공하면 웹사이트 결과물의 품질이 얼마나 개선되는가?
  • 한국어 글쓰기의 낮은 평가는 반복 평가에서도 재현되며, 출력 품질의 편차는 어느 정도인가?

관련 문서

공통 태그와 주제 흐름을 기준으로 같이 보면 좋은 문서를 이어서 제안합니다.