I tested every effort level on Claude Opus 5.5
Quick Summary
Claude Opus 5.5의 여섯 가지 노력 수준으로 소닉 게임을 만든 비교에서, 낮은 수준은 속도가 돋보였고 높은 수준은 시각적 완성도가 좋아졌지만 조작 오류까지 해결되지는 않았다.
영상 보기
클릭 전까지는 가벼운 미리보기만 먼저 불러옵니다.
🖼️ 인포그래픽

🖼️ 4컷 인포그래픽

💡 한 줄 결론
Claude Opus 5.5의 여섯 가지 노력 수준으로 소닉 게임을 만든 비교에서, 낮은 수준은 속도가 돋보였고 높은 수준은 시각적 완성도가 좋아졌지만 조작 오류까지 해결되지는 않았다.
📌 핵심 요점
- 모든 세션에 같은 요청을 전달했다. 소닉 게임을 재현하되, 측면 시점과 어깨 너머의 레이싱 시점을 전환할 수 있는 사실적인 3D 게임을 요구했다.
- 제작 시간은 Low 2분 미만, Medium 약 18분, High 약 30분, X High 61분으로 늘었다. 이어 소개한 실행은 사용량 제한과 재개를 거쳐 약 1시간 53분이 걸렸다고 설명한다.
- Low는 빠르게 플레이 가능한 결과를 냈지만 소리가 없고 시점을 바꿔도 조작 방식이 그대로였다. Medium은 소리, 시점에 따른 조작 전환, 좌우 이동과 배경 표현에서 개선을 보였다.
- High는 1인칭을 포함한 여러 시점을 제공했다. 이후 결과물에서도 인상적인 환경이 등장했지만, X High의 조작 문제와 미완성 다리 등 기능적 결함이 함께 관찰됐다.
- Ultra Code는 한때 하위 에이전트 7개를 가동했고 제작자가 중단을 지시했다. 시작 화면과 환경은 호평받았으나 지연과 전진 키 문제가 남았으며, API 환산 비용은 측정하지 않았다.
🧩 배경과 문제 정의
제작자는 어린 시절 좋아했던 소닉 게임을 만드는 과제로 Claude Opus 5.5의 여섯 가지 노력 수준을 나란히 비교한다. 요청은 단순한 측면 게임 재현을 넘어, 시점 전환과 사실적인 3D 환경을 구현하도록 구성했다. 자막에는 ‘1인칭’과 ‘어깨 너머’라는 표현이 함께 등장해 원하는 카메라 방식에는 다소 모호함이 있다.
비교의 핵심은 더 오래 작업하는 설정이 더 나은 게임을 만드는지다. 영상은 제작 시간과 직접 플레이한 인상을 중심으로 진행하며, 시각적 세부 표현뿐 아니라 시점에 맞는 조작 전환도 주요 평가 요소로 드러난다. 동일 요청을 사용했지만 사용량 제한, 다른 프로젝트의 병행 실행, Ultra Code 중단이 개입했고 비용은 측정하지 않았다.
🕒 시간순 섹션별 상세정리
1. 비교 과제와 제작 시간
- 여섯 가지 노력 수준에 같은 요청을 전달한다. 수준별 폴더에 소닉 게임을 만들고, 측면 시점과 어깨 너머 레이싱 시점을 전환하며 사실적인 3D 표현을 구현하도록 요구한다. [00:45]
- Low는 2분 미만, Medium은 약 18분, High는 약 30분, X High는 1시간 1분이 걸렸다. 이어 소개한 실행은 사용량 제한 후 재개됐고 총 약 1시간 53분이 걸렸다고 설명하며, 당시 다른 프로젝트도 병행했다고 덧붙인다. [01:53]
- Ultra Code는 하위 에이전트를 연달아 실행해 한때 7개가 작동했다. 제작자는 계속 기다리기를 원하지 않아 중단을 지시했으며, 이후 로컬 포트에 나눠 띄운 결과물을 확인한다. [02:34]
2. Low와 Medium의 속도·조작 차이
- Low에서는 소리가 들리지 않고, 카메라를 바꿔도 측면 시점 기준의 조작을 유지해야 했다. 제작자는 불편함을 지적하면서도 약 2분 만에 만든 결과로는 나쁘지 않다고 평가한다. [03:19]
- Low의 언덕 이동은 느렸고 마지막 보스도 보이지 않았다. Medium에서는 소리가 나오고 초기의 이상 현상은 자동으로 해소되는 모습을 보였다. [03:54]
- Medium은 레이싱 시점에서 조작 방식이 바뀌고 좌우 이동도 가능했다. 바다의 표현과 효과음을 호평했지만 장애물 식별은 아쉬워했으며, 아래 방향키와 스페이스를 이용한 돌진도 확인했다. [05:03]
3. High의 시점 확장
- High에서는 전진 조작을 확인하며 Low가 반영하지 못한 부분이라고 보여준다. 캐릭터의 외형은 소닉보다 아르마딜로처럼 보인다고 반응한다. [05:26]
- 여러 카메라 시점과 1인칭 전환을 확인한다. 두 시점만 제공한 Medium과 차이가 있었지만, 이 결과물에도 마지막 보스는 보이지 않았다. [06:04]
4. X High에서 남은 조작 문제
- X High에서도 비슷한 캐릭터와 초기 이상 현상이 나타났다. 제작자는 시점에 맞춰 조작이 바뀌지 않은 점을 높은 노력 수준에 비춰 의외라고 평가한다. [06:37]
- 플레이 중 소리가 지나치게 크다고 느껴 줄였고, 이후 좌우 이동이 되지 않는 상황도 지적했다. 높은 수준에서도 조작 완성도가 일관되게 확보되지는 않았다. [07:33]
5. 후속 플레이의 환경 표현과 미완성 구간
- 이후 플레이에서는 1인칭 시점과 넓은 환경을 살펴본다. 다리가 완성되지 않아 되돌아가기 어려운 상황이 있었지만 세계의 표현 자체는 인상적이라고 평가한다. 이 구간의 설정 전환은 자막만으로 명확하지 않다. [08:26]
- 제작자는 당시 결과물을 지금까지 중 가장 좋다고 평가하고 소닉의 재해석을 마음에 들어 했다. 원작과 완전히 같지 않은 이유는 저작권·지식재산권 보호 때문이라고 설명하지만, 별도 근거를 제시하지는 않는다. [09:27]
6. Ultra Code의 시각적 강점과 사용성 결함
- Ultra Code에서는 인터페이스 이상과 긴 로딩을 지적한다. 이후 시작 화면은 가장 좋다고 평가하고 배경에도 감탄하지만, 플레이 중 지연이 나타난다. [10:35]
- 시점을 바꾼 뒤 W 키가 전진으로 작동하지 않는 점을 지적한다. 높은 수준의 설정이라면 이 조작을 제대로 처리했어야 한다는 기대를 드러낸다. [10:55]
- 분수 같은 환경 세부 표현을 감상하고, 뒤로 돌아갈 수 있는 동작에는 긍정적으로 반응한다. 시각적 만족과 조작 불편이 함께 나타난 시연이다. [12:04]
7. 최종 평가와 비용 측정의 공백
- 제작자는 낮은 노력 수준의 속도에 놀랐으며 전반적으로 노력을 높일수록 결과가 좋아졌다고 평가한다. 다만 Ultra Code의 시점별 키 배치 문제를 다시 지적하면서 Max와 X High에 대한 선호를 언급한다. [13:11]
- 모든 노력 수준을 나란히 비교한 점에 의미를 두지만, API 토큰 기준의 환산 비용을 계산하지 못한 점은 아쉬움으로 남긴다. [13:28]
- 자신은 AI 전문가가 아니라 프로젝트를 공개적으로 만들며 효과가 있었던 것을 공유한다고 보여준다. 시청자의 직업·대상 독자·질문에 맞춘 후속 주제를 요청하며 영상을 마친다. [13:53]
🧾 결론
- 제작자는 전반적으로 노력 수준이 높을수록 결과물이 좋아졌다고 평가했다. 다만 영상에서 확인되는 개선은 시각적 표현과 기능 정확도에 고르게 나타나지는 않는다.
- 낮은 노력 수준의 빠른 제작은 인상적이었고, Medium도 조작과 표현에서 유의미한 개선을 보여줬다. 적절한 수준은 필요한 기능과 기다릴 수 있는 시간에 따라 달라진다.
- 마지막에는 Max와 X High에 대한 선호를 언급했다. 그러나 반복 실험과 비용 자료가 없어 이를 보편적인 최적 설정으로 단정할 수 없다.
📈 투자·시사 포인트
- AI 코딩 도구를 평가할 때 생성 화면의 인상뿐 아니라 실제 조작, 요구사항 충족, 제작 시간을 함께 봐야 한다는 사례다.
- 높은 노력 수준과 다수의 하위 에이전트 사용이 사용자 경험 개선으로 얼마나 이어지는지 별도 검증이 필요하다. 이 영상에서는 Ultra Code에도 기본 조작 문제가 남았다.
- 사용량 제한과 작업 중단은 도입 시 생산성 판단에 영향을 줄 수 있다. 다만 다른 프로젝트도 동시에 실행했으므로 제한 도달을 이번 비교만의 결과로 볼 수 없다.
- API 비용과 반복 측정이 빠져 있어 모델의 경제성, 서비스 수익성 또는 투자 가치를 판단할 근거로는 부족하다.
⚠️ 불확실하거나 확인이 필요한 부분
- 모델명과 노력 수준 명칭은 영상의 표기를 따른다. 제공된 자막만으로 공식 제품명이나 설정 체계와의 일치 여부를 확인할 수 없다.
- 약 1시간 53분이 걸린 다섯 번째 실행의 이름과 후반 플레이 화면의 전환 지점은 자막에서 명확하지 않다. 마지막에 Max를 언급하지만 모든 장면을 해당 설정에 확정적으로 연결하기는 어렵다.
- 사용량 제한 당시 다른 프로젝트도 실행 중이었다. Ultra Code에는 제작자의 중단 지시까지 개입해 실행 조건이 완전히 같지 않다.
- 자막 기반 정리: 타임스탬프가 있는 자막을 기준으로 정리했으며, 고유명사·수치·인용은 원문 확인 필요 시 별도 검증한다.
- 영상 속 주장: 발표자의 해석·전망·비교는 확인된 외부 사실이 아니라 영상 속 주장으로 분리해 읽는다.
- 검증 필요: 수치, 기업 실적, 정책·시장 전망은 발행 전 최신 자료로 별도 검증이 필요하다.
✅ 액션 아이템
- 동일 요청을 여러 차례 실행하고, 각 세션의 정확한 설정명과 완료·중단 상태를 기록한다.
- 시점 전환 후 전진·좌우 이동, 소리, 충돌, 코스 완주 여부를 공통 체크리스트로 검증한다.
- 실제 작업 시간, 제한으로 인한 대기 시간, 토큰 사용량과 비용을 분리해 측정한다.
- Low와 Medium으로 초기 결과를 확인한 뒤, 부족한 기능이 상위 수준에서 실제로 개선되는지 비교한다.
❓ 열린 질문
- 같은 조건에서 반복해도 노력 수준에 따른 시각적 품질과 조작 정확도의 차이가 유지될까?
- 토큰 비용까지 포함하면 어떤 수준이 필요한 품질을 가장 효율적으로 달성할까?
- 시점별 키 배치를 요청에 명시하면 Low와 Ultra Code에서 관찰한 조작 문제가 줄어들까?