YouTubeTonbi''s AI Garage·2026년 9월 7일·0

First Look at GPT-6 Astra: Has AGI Arrived?

Quick Summary

GPT 6 Astra의 첫인상은 게임 물리와 Blender 작업에서 강점을 보이는 빠른 모델이지만, 이번 시연만으로 AGI 도달이나 경쟁 모델에 대한 전면적 우위를 판단할 수는 없다는 것이다.

영상 보기

클릭 전까지는 가벼운 미리보기만 먼저 불러옵니다.

원본 열기

🖼️ 인포그래픽

First Look at GPT-6 Astra: Has AGI Arrived? 내용을 설명하는 본문 이미지

🖼️ 4컷 인포그래픽

First Look at GPT-6 Astra: Has AGI Arrived?의 핵심 내용을 4단계로 요약한 인포그래픽
First Look at GPT-6 Astra: Has AGI Arrived? 핵심 내용을 4단계로 압축한 4컷 인포그래픽

💡 한 줄 결론

GPT-6 Astra의 첫인상은 게임 물리와 Blender 작업에서 강점을 보이는 빠른 모델이지만, 이번 시연만으로 AGI 도달이나 경쟁 모델에 대한 전면적 우위를 판단할 수는 없다는 것이다.

📌 핵심 요점

  1. 발표자는 높은 벤치마크 수치를 소개한 뒤 동일한 프롬프트로 실제 작업을 비교한다. 영상의 판단 기준은 점수뿐 아니라 실행 속도, 결과물의 미감, 요구사항 충족 여부다.
  2. 소닉 스타일 게임은 링, 구르기, 적과의 전투 등 주요 요소를 구현했다. 발표자는 Astra의 물리·게임 동작을 높게 평가하면서도 외형과 색상은 Fable 쪽을 선호한다.
  3. 문학 문단을 바탕으로 만든 3D 세계는 Astra가 더 부드럽게 실행됐지만, Fable은 색채와 미술적 표현에서 매력을 보였다. 발표자의 최종 평가는 취향에 따라 갈리는 사실상 무승부다.
  4. Blender에서는 미끄럼틀 재현과 해적선 애니메이션이 인상적이었다. 각각 약 10분과 17분이 걸렸으며, 이전 Soul 결과보다 나아진 부분이 있지만 형태 오류와 배경 오브젝트 겹침은 남았다.
  5. 랜딩 페이지는 약 11분 만에 완성됐지만 핵심인 스크롤 연동 영상과 요구한 인터랙션이 제대로 구현되지 않았다. 발표자는 프런트엔드에 Fable을 계속 쓰겠다고 했으며, 전체 시연에서 주간 한도가 25%포인트 줄었다는 점도 강조한다.

🧩 배경과 문제 정의

제목은 GPT-6 Astra의 등장과 AGI 가능성을 묻지만, 본문의 중심은 제작 작업에 투입했을 때 무엇을 잘하고 어디서 실패하는지 확인하는 첫 사용기다. 발표자는 직전 Fable 영상과 같은 프롬프트를 사용해 게임, 문학 기반 3D 세계, Blender 모델링, 랜딩 페이지를 살펴본다.

비교 기준은 작업마다 다르다. 게임에서는 물리와 외형, 3D 세계에서는 색채와 재생 성능, 참고 이미지 재현에서는 형태 정확도, 웹에서는 디자인과 인터랙션 작동 여부가 중요하다. 따라서 결과물을 보기 좋게 생성하는 능력과 요청한 기능을 완성하는 능력을 구분해 읽어야 한다.

아래 정리는 제공된 전사에 담긴 발표자의 설명과 관찰을 따른다. 제품 사양과 벤치마크 수치는 영상 속 주장으로 다루며, 최종 결론도 제한된 시연에서 드러난 작업별 적합성에 맞춘다.

🕒 시간순 섹션별 상세정리

1. 소닉 스타일 게임으로 시작한 첫인상

  • 과거 문명 스타일 게임에 썼던 에셋으로 소닉 스타일 게임을 만들어 달라고 요청했다. 결과물에는 링, 구르기, 적과의 전투가 포함됐고 발표자는 외형을 긍정적으로 평가한다. [00:31]
  • 제작 모델을 OpenAI의 Astra라고 소개하고 소닉의 물리를 잘 재현했다고 드러낸다. 이후 비교에는 지난주 Claude Fable에 사용한 것과 같은 프롬프트를 쓰겠다고 보여준다. [01:01]

2. 출시 설명과 벤치마크 비교

  • 발표자는 GPT-6 Astra가 점진적으로 배포됐으며 금요일에 Codex 구독자에게 열렸다고 보여준다. AGI와 초지능에 관한 화제를 언급하지만 이를 직접 검증하지는 않는다. [01:27]
  • ARC-AGI 3에서 99.9%라는 수치를 소개하고 Terminal Bench 4.0에서는 Fable 5.1보다 몇 점 앞선다고 드러낸다. 반면 Deep WSC와 도구를 사용하는 인문학 시험에서는 뒤졌다고 보여준다. [02:11]
  • 컴퓨터 사용에서는 OS world 2.0 점수가 65.7%에서 72.6%로 올랐고 작업당 시간이 47% 줄었다고 보여준다. 이후 Blender 작업으로 실제 동작을 살펴볼 계획이다. [02:44]

3. 긴 문맥과 실행 중 작업 제어

  • 문맥 창이 차더라도 메모를 유지하고 이전 메시지와 도구 결과를 검색할 수 있다고 보여준다. 소개된 검색 벤치마크 수치는 Soul의 73.8% 대비 96.3%다. [03:02]
  • 비동기 도구를 통해 도구 실행 중에도 독립적인 작업을 이어가며, 웹소켓으로 진행 중인 작업에 수정 지시를 보낼 수 있다고 드러낸다. [03:19]
  • 대화 도중 추론 노력을 바꾸면서 캐시된 프롬프트 접두부를 유지할 수 있다고 보여준다. [03:26]

4. 감독 가능성과 비용의 유보 사항

  • 반복적 깊이를 사용하는 추론 방식은 감시를 어렵게 하지만 감시가 불가능한 것은 아니라고 보여준다. 더 강한 제약 준수와 외부 도구 사용에 대한 추가 감시도 언급한다. [04:01]
  • 가격은 Fable과 같은 입력 10달러·출력 50달러라고 소개하되 과금 단위는 말하지 않는다. 빠른 모드가 있으며 프롬프트 캐시 효율과 토큰 소모는 실제 사용에서 살펴봐야 한다고 덧붙인다. [04:25]
  • 벤치마크 소개를 마치고 같은 프롬프트를 통한 실제 결과물 비교로 전환한다. [04:48]

5. 문학 문단으로 3D 세계 만들기

  • 『반지의 제왕』 첫 문단을 바탕으로 3D 세계와 영화 같은 장면을 만드는 과제다. 발표자는 이 아이디어가 Andrej Karpathy의 게시물에서 출발했다고 보여준다. [05:10]
  • 기존 Fable 5.1 결과는 세부 표현이 뛰어났지만 느리고 끊겼다. Astra에도 동일한 프롬프트를 입력했으며 작업은 17분 걸렸다고 드러낸다. [05:44]
  • 100달러 요금제를 사용 중이며, 앞선 두 작업으로 주간 잔여 한도가 90%에서 70%로 줄었다고 보여준다. [06:00]

6. 3D 세계의 부드러운 실행과 시각적 취향

  • Astra 결과는 둥근 형태와 케이크·연기·터널 같은 세부 요소가 눈에 띈다. 다소 끊기지만, 합리적인 속도로 보려고 10배 가속했다는 Fable 결과보다 부드럽다고 평가한다. [07:13]
  • Fable은 하늘과 전체 색채의 풍부함에서 장점이 있고 Astra는 조금 단순해 보이지만 더 잘 실행된다고 드러낸다. 같은 장면의 외형과 움직임을 번갈아 비교한다. [08:11]
  • 둥근 형태와 다각형 스타일의 차이 때문에 어느 쪽이 더 좋은지 쉽게 결정하지 못한다. 둘 다 자신의 이전 시도보다 좋다며 최종 선호는 시청자에게 맡긴다. [10:10]

7. Blender에서 미끄럼틀 재현에 도전

  • Codex에서 MCP로 Blender에 연결한다. 이전 Soul 작업에서는 여러 지시를 거쳐도 어린이 미끄럼틀의 계단을 제대로 재현하지 못했다고 보여준다. [11:08]
  • Astra의 중간 설정으로 여러 각도의 참고 이미지를 제공하고, 색상과 형태를 정확히 맞춘 미끄럼틀을 단순한 정원 장면에 배치하도록 요청한다. [11:36]
  • 참고 이미지에 계단이 명확히 드러나지 않아 보이지 않는 구조를 추론해야 한다. 발표자는 평평한 물체보다 복잡한 형태를 얼마나 이해하는지 보려 한다. [12:03]

8. 미끄럼틀 결과의 개선과 남은 형태 오류

  • 작업은 약 10분 만에 끝났다. 작은 표식까지 반영됐으며 이전 Soul 결과보다 참고 이미지에 훨씬 가깝다고 평가한다. [12:34]
  • 하부 높이와 울타리 등 일부 형태는 정확하지 않다. 그래도 첫 시도 결과가 기존 Soul 작업보다 낫다고 드러낸다. [12:56]
  • Blender 내부 장면을 확인하면서 복잡한 구조의 완전한 이해는 여전히 어렵다고 평가한다. 결과는 빠르고 상당히 괜찮았다는 판단이다. [13:21]

9. 해적선과 바다 애니메이션 제작

  • 바다와 배경 섬, 발사되는 포탄을 포함한 장면을 요청한다. 배는 『원피스』의 메리호 외형을 찾아 그대로 닮게 만들도록 지시한다. [13:38]
  • 첫 Blender 작업이 사용한 한도는 2%포인트였다고 보여준다. 해적선 작업 중에는 나무와 돛대, 배경 섬 등을 확인하며 긍정적으로 평가한다. [14:27]
  • 작업은 17분이 걸렸고 완성된 애니메이션은 6초다. 배와 포탄, 물 표현은 좋지만 배경 나무가 겹치는 문제가 있으며, 한 번의 요청으로 만든 초안으로는 발전시킬 가치가 있다고 본다. [15:17]

10. 3D 에셋 활용 가능성과 웹 과제의 조건

  • 발표자는 Blender 결과가 게임 개발과 3D 에셋 제작에 유용할 것으로 본다. 이어 잔여량이 66%라고 언급한다. [15:57]
  • 마지막 과제는 기존 공룡 영상 프로젝트의 이미지와 영상을 찾아 창의적이고 즐거운 랜딩 페이지를 만드는 것이다. 시각적 방향은 모델에 맡긴다. [16:30]
  • 필수 조건은 스크롤에 연동되는 영상, 최소 3개의 추가 인터랙션, 추가 다운로드 없이 브라우저에서 정상 작동하는 결과물이다. [16:43]

11. Fable 기준작과 Astra의 빠른 완성

  • Fable의 기존 페이지는 제공된 영상을 활용해 스크롤에 따라 재생되며, 작은 인터랙션도 갖췄다. 영상 자체는 발표자가 만든 것이고 모델은 페이지를 구성했다고 구분한다. [17:31]
  • Astra는 약 11분 만에 결과를 냈다. 발표자는 비교 도구에서 두세 배 더 오래 걸리는 경향을 봤다며 속도를 높게 평가하지만 정밀한 시간 비교표를 제시하지는 않는다. [17:55]

12. 랜딩 페이지의 핵심 기능 실패

  • Astra 페이지에는 움직이는 요소와 영상 조각이 있지만 요구한 스크롤 연동 영역은 작동하지 않는다. 일부 이미지는 어색하게 잘려 있다. [18:45]
  • 발표자는 영상과 인터랙션을 추가로 확인한 뒤 결과를 실패라고 평가한다. 프롬프트 문제 가능성을 언급하면서도 Fable에 동일한 지시를 사용했다는 점을 강조한다. [19:45]
  • Fable 페이지에서는 스크롤을 되돌리면 영상도 역방향으로 움직이는 동작을 보여준다. 발표자는 Astra가 요청한 인터랙션을 충족하지 못했다고 판단하고 프런트엔드에서 Claude의 명확한 승리라고 정리한다. [20:23]

13. 작업별 모델 선택에 대한 잠정 결론

  • 게임은 Astra의 물리와 동작이 좋았지만 외형은 Fable을 선호한다. 호빗 세계는 Fable의 색채와 Astra의 실행 성능이 맞서 대체로 무승부라고 본다. [21:06]
  • 가장 인상적인 사례로 Blender 해적선을 꼽는다. Astra를 게임 물리·메커니즘과 Blender 모델링에 사용하고 Godot에서도 시험할 계획이라고 드러낸다. [21:49]
  • 3.js 작업은 어느 쪽도 가능하지만 프런트엔드와 게임의 미술 방향은 Fable을 선호한다. 마지막 웹 작업의 한도 소모는 1%포인트였다고 덧붙인다. [22:15]

14. 사용 한도와 과열된 평가 사이의 마무리

  • 전체 시연으로 주간 한도가 시작점 대비 25%포인트 줄었다고 보여준다. 사용량을 고려해 복잡한 코딩 작업에 선택적으로 투입하고 Hermes와 Codex에서 더 활용할 생각이다. [22:45]
  • X에서는 극찬과 실망이 모두 나타난다고 전해진다. 자신은 좋은 모델이라고 보지만 Fable을 완전히 압도한다고 생각하지는 않으며, 정확한 활용처를 알기 위해 더 써봐야 한다고 드러낸다. [23:21]
  • 시청자의 사용 경험을 요청하며 첫 사용기를 마친다. [23:29]

🧾 결론

  • 이 영상이 보여주는 것은 작업별 강점의 차이다. 발표자는 Astra를 게임 물리·메커니즘과 Blender 모델링에, Fable을 프런트엔드와 게임의 미술 방향에 배치한다.
  • 빠른 생성과 높은 완성도는 별도로 평가해야 한다. 랜딩 페이지 사례에서는 빠르게 끝났어도 핵심 기능이 작동하지 않았다.
  • AGI 여부는 입증되지 않았다. 발표자도 Astra를 좋은 모델로 평가하지만 Fable을 완전히 압도한다는 주장에는 동의하지 않으며 추가 사용이 필요하다고 정리한다.

📈 투자·시사 포인트

  • 게임 개발과 3D 에셋 제작에서는 초안 생성 시간을 줄일 가능성이 드러난다. 다만 형태 수정과 시각적 검수가 남아 있어 제작비 절감 규모까지 이 영상으로 계산할 수는 없다.
  • 모델 선택은 단일 순위보다 업무별 성과에 맞추는 편이 타당하다. 물리 구현, 모델링, 시각 디자인, 웹 인터랙션을 나누어 평가할 근거가 제시된다.
  • 경제성은 생성 시간과 사용 한도를 함께 봐야 한다. 앞선 두 작업은 주간 잔여 한도를 20%포인트 줄였지만 첫 Blender 작업은 2%포인트, 마지막 프런트엔드 작업은 1%포인트를 사용했다고 설명한다.
  • 이 자료에는 기업 실적이나 투자수익률을 판단할 근거가 없다. 산업적 시사점은 제작 도구로서의 활용 가능성과 실제 요구사항을 검증하는 과정의 중요성에 한정된다.

⚠️ 불확실하거나 확인이 필요한 부분

  • 모델 출시 경위, 구독 접근 조건, 벤치마크 성적과 안전장치 설명은 발표자가 소개한 주장이다. 제공된 전사만으로 공식 발표 내용이나 측정 조건을 독립적으로 확인할 수 없다.
  • 입력 10달러·출력 50달러라는 가격 설명에는 과금 단위가 명시되지 않는다. 이를 특정 토큰 수 기준 요금으로 단정하거나 구독 한도와 직접 환산하면 안 된다.
  • 동일 프롬프트를 사용했다고 하지만 반복 실험 횟수, 실행 환경, 전체 설정, 비교 모델의 정확한 소요 시간은 충분히 제시되지 않는다. 결과를 일반적인 성능 순위로 확대하기 어렵다.
  • 자막 기반 정리: 타임스탬프가 있는 자막을 기준으로 정리했으며, 고유명사·수치·인용은 원문 확인 필요 시 별도 검증한다.
  • 영상 속 주장: 발표자의 해석·전망·비교는 확인된 외부 사실이 아니라 영상 속 주장으로 분리해 읽는다.
  • 검증 필요: 수치, 기업 실적, 정책·시장 전망은 발행 전 최신 자료로 별도 검증이 필요하다.

✅ 액션 아이템

  • 같은 에셋과 프롬프트로 작업을 반복하고, 모델 설정·완료 시간·수정 횟수·한도 감소량을 함께 기록한다.
  • 게임은 물리와 조작 동작, 3D 결과물은 형태·색상·오브젝트 겹침, 웹은 스크롤 연동 영상과 최소 3개 인터랙션을 각각 확인한다.
  • Blender 결과물은 렌더 이미지뿐 아니라 실제 장면을 열어 계단, 하부 높이, 울타리, 배경 오브젝트를 여러 각도에서 검수한다.
  • 구독 한도와 과금 단위를 확인한 뒤, 복잡한 코딩·모델링 작업에 사용할 예산을 배정한다.

❓ 열린 질문

  • Astra의 속도 이점은 오류 수정과 요구사항 재검증까지 포함해도 유지되는가?
  • 랜딩 페이지 실패는 반복 실행이나 프롬프트 보완으로 해결되는가, 아니면 해당 유형에서 지속적으로 나타나는 약점인가?
  • 더 명확한 다각도 참고 이미지를 주면 미끄럼틀의 계단과 복잡한 형태를 정확히 재현할 수 있는가?

관련 문서

공통 태그와 주제 흐름을 기준으로 같이 보면 좋은 문서를 이어서 제안합니다.