ArticleDominic-Madori Davis·2026년 9월 26일·0

I created an interactive digital avatar of myself — and you can talk to it

Quick Summary

TechCrunch 기자 Dominic Madori Davis는 Synthesia로 자신의 디지털 아바타를 제작·체험하며, 제한된 주제의 질의응답과 기업 교육 활용 가능성, 저널리즘의 신뢰와 심리적 이질감이라는 한계를 함께 살폈다.

I created an interactive digital avatar of myself — and you can talk to it 관련 대표 이미지

🖼️ 인포그래픽

I created an interactive digital avatar of myself — and you can talk to it 내용을 설명하는 본문 이미지

🖼️ 4컷 인포그래픽

I created an interactive digital avatar of myself — and you can talk to it의 핵심 내용을 4단계로 요약한 인포그래픽
I created an interactive digital avatar of myself — and you can talk to it 핵심 내용을 4단계로 압축한 4컷 인포그래픽

💡 한 줄 요약

TechCrunch 기자 Dominic-Madori Davis는 Synthesia로 자신의 디지털 아바타를 제작·체험하며, 제한된 주제의 질의응답과 기업 교육 활용 가능성, 저널리즘의 신뢰와 심리적 이질감이라는 한계를 함께 살폈다.

📌 핵심 요약

  • Synthesia는 2026년 기업가치 40억 달러에 도달했으며, 2025년 연간 반복 매출(ARR)이 1억 달러를 넘었다고 밝혔다. 최근 출시한 Roleplay Sessions는 직원이 대화형 AI 아바타와 영업 발표 등을 연습하고 응답 평가를 받도록 지원한다.
  • Dominic-Madori Davis는 Synthesia의 뉴욕 사무실에서 여러 장의 사진과 2분 분량의 음성을 제공하고 제작에 동의했다. 며칠 뒤 안경 착용 여부에 따라 대본을 읽는 개인 아바타와 대화형 아바타를 각각 받았다.
  • 대화형 아바타는 벤처투자를 받은 스타트업의 사기에 관한 기자 자신의 기사만 답변하도록 구성됐다. 이전 직장이나 거주지, 가족만 아는 개인적인 질문에는 답하지 않고 해당 기사로 대화를 돌렸다.
  • 아바타는 음성 인식, 언어, 음성 합성, 영상 모델을 결합한다. Synthesia는 대본 기반 영상 제작·배포, 대화형 Sessions, API 플랫폼을 제공하며, 고객은 일부 모델과 클라우드 호스팅 방식을 선택할 수 있다.
  • 기자와 지인들의 반응은 흥미와 감탄부터 목소리·외모의 유사성에 대한 의문과 섬뜩함까지 갈렸다. 기자는 기업에서의 상시 응답 가능성을 긍정적으로 보면서도 저널리즘의 신뢰를 AI에 맡기기 어렵다고 판단했고, 자유롭게 발언하는 아바타의 심리적 위험을 우려했다.

🧩 주요 포인트

  1. 기사로 제한된 답변 범위 → 정해진 내용을 설명하는 기능은 확인됐지만, 기자 개인의 지식이나 판단 전체를 재현한 것은 아니다.
  2. 여러 모델의 결합과 세 가지 제품군 → Synthesia의 활용 범위가 대본 낭독에서 기업 교육과 대화형 서비스 개발로 넓어진다.
  3. 상시 응답의 편의성과 엇갈린 체험 반응 → 아바타의 도입 가치는 저널리즘의 신뢰, 재현 품질, 심리적 수용성을 함께 고려해야 한다.

🧠 상세 정리

1. 홍보 담당자의 아바타에서 시작된 체험

TechCrunch 기자 Dominic-Madori Davis는 여름에 Synthesia의 기업 업무 총괄 Alexandru Voica로부터 그의 대화형 가상 아바타 링크를 받았다. 회사가 무엇을 하고 어떻게 작동하는지 등 언론의 일반적인 질문에 답하도록 훈련된 아바타였다. 바로 전날 홍보 담당자들과 AI로 작성한 제안문에 관해 이야기했던 기자에게, 이 아바타는 홍보 분야의 AI 활용이 한층 더 나아간 사례로 다가왔다. 영국에서 출발한 Synthesia는 D-ID, HeyGen, Colossyan 등과 함께 디지털 아바타 시장에서 활동하며, 2026년 기업가치 40억 달러에 도달했고 2025년에는 ARR 1억 달러를 넘었다고 밝혔다. 기업용 교육 영상 제작을 지원하는 이 회사는 직원이 아바타를 상대로 영업 발표 등을 연습하고 응답 평가를 받는 Roleplay Sessions도 최근 출시했다.

2. 동의를 거쳐 만든 개인·대화형 아바타

9월 뉴욕의 새 사무실을 방문한 기자는 자신의 AI 아바타를 만들어 보겠다는 제안을 바로 받아들였다. 이전까지 아바타에 큰 관심은 없었지만, 온라인 일상의 일부가 될 것으로 생각했고 자신을 닮은 아바타로 소셜 콘텐츠를 만드는 사례에도 흥미를 느꼈다. 제작 과정에서는 사무실 안의 작은 촬영 공간에서 여러 장의 사진을 찍고 2분 분량의 음성을 녹음했으며, 아바타 제작에 동의했다. 회사는 안경을 쓴 모습과 쓰지 않은 모습으로, 입력한 대본을 읽는 개인 아바타와 말을 듣고 응답하는 대화형 아바타를 각각 제작했다. 원문에 따르면 Voica 외 인물을 대상으로 이런 디지털 아바타를 만든 것은 이번이 처음이며, 대화형 버전은 벤처투자를 받은 스타트업이 그렇지 않은 스타트업보다 사기를 더 많이 저지르는 이유를 다룬 기자의 기사만 답변하도록 구성됐다.

3. 모델 결합 구조와 세 가지 제품군

대화형 아바타는 음성 인식 모델이 발화를 텍스트로 바꾸고, 에이전트형 언어 모델이 내용을 해석해 그에 따른 행동을 수행할 수 있는 구조다. 이어 음성 합성 모델이 답변을 음성으로 만들고, Synthesia의 영상 모델이 말하는 아바타의 움직임을 생성한다. 기자의 아바타에는 Synthesia 자체 영상·음성 모델이 포함됐지만, 고객은 Cartesia, ElevenLabs, Google, OpenAI 등의 대체 모델도 선택할 수 있다. 기업은 원하는 클라우드에 아바타를 호스팅하거나 Synthesia에 비용을 지불해 호스팅을 맡길 수 있다. 회사의 제품은 대본을 읽는 기존 아바타를 활용한 영상 제작·배포 플랫폼, 설문이나 역할극으로 아바타와 상호작용하는 Sessions, 영상·음성 모델을 다른 기술 서비스와 결합하는 API 플랫폼의 세 가지로 나뉜다.

4. 재현 품질은 엇갈렸지만 답변 범위는 유지

제작에는 며칠이 걸렸고, 기자는 먼저 개인 아바타에 자신이 좋아하는 뉴욕의 가을에 관한 평범한 대본을 입력했다. 기자 자신은 음성이 상당히 정확하며 녹음 당시의 쉰 목소리까지 재현하지 않은 점도 만족스럽다고 평가했다. 기술업계 밖의 친구들은 흥미롭지만 섬뜩하다는 반응을 보였고, 대화형 버전의 목소리는 실제 기자와 많이 닮지 않았으며 외모도 개인 버전보다 덜 비슷하다고 느꼈다. 원문에서 결정론적이라고 설명한 대화형 아바타는 이전 직장과 뉴욕의 거주 지역을 묻는 질문에 답하지 않고 벤처 사기 기사로 대화를 돌렸다. 부모가 가족만 알 만한 내용을 물었을 때도 같은 제한을 유지했으며, 어머니는 이를 놀랍다고 평가하면서도 두 명을 낳은 기억은 없다고 농담했다.

5. 저널리즘의 활용 가능성과 신뢰의 문제

체험은 아바타가 뉴스를 전달하거나 기자를 보완하고 나아가 대체할 수 있는지에 대한 질문으로 이어졌다. 아바타가 진행하는 뉴스를 사람들이 받아들이겠느냐는 물음에 한 투자자는 즉각 부정적으로 답했지만, 다른 사람들의 반응은 확정적이지 않았다. 기자는 소셜미디어와 뉴스 공유 플랫폼에 퍼진 저품질 AI 콘텐츠에 대한 반발도 이런 논의의 배경으로 제시했다. CEO가 실제 기자 대신 기자의 AI 아바타와 대화하고 싶어 할지도 아직 답이 없는 질문으로 남았다. 기자는 사람들과 연결되고 기사를 쓰며 새로운 주제를 조사하는 일을 좋아하지만, 저널리즘에서 가장 큰 부분은 신뢰이며 이를 AI에 맡길 수 있을 것 같지는 않다고 밝혔다. 반면 기업 업무에서는 자신의 복제본이 계속 질문에 답할 수 있다는 점에서 휴가 이후 밀린 일을 줄이는 방식이 매력적일 수 있다고 보았다.

6. 신기함 이후의 이질감과 심리적 우려

처음의 신기함이 가신 뒤 기자는 말하기를 멈춘 아바타를 바라보며 눈을 깜박이거나 웃거나 새로운 말을 하기를 기다리는 자신을 발견했다. 이는 아바타가 무언가를 알고 있다는 신호를 기대하는 듯한 경험이었지만, 기자는 자신의 디지털 분신이 정해진 응답 범위에 묶여 있어 그런 기대를 충족하지 못한다고 설명했다. 반면 자유롭게 말을 이어갈 수 있는 챗봇 기반 아바타라면 사용자가 이른바 AI 정신증과 같은 상태에 빠질 가능성을 상상할 수 있다고 우려했으며, 이는 관찰된 피해가 아니라 기자의 추측이다. 기자는 자신이 속한 Z세대도 디지털 분신에 익숙해지기 어려울 것이라고 한 투자자에게 예측했는데, 영화에서 보던 장면이 현실이 된 듯한 공상과학적 느낌 때문이었다. 그래도 상황이 이상해지면 로그아웃할 수 있다는 점에서 디지털 아바타가 휴머노이드보다 덜 당혹스럽다고 덧붙였고, 마지막에는 자신의 개인 아바타가 사이트의 주간 주요 기사를 소개하는 영상을 제시했다.

🧾 핵심 주장 / 시사점

  • 답변 범위를 기사 하나로 제한한 설계는 기자의 설명을 전달하는 기능과 기자 개인을 재현하는 기능 사이의 차이를 드러낸다.
  • 개인 아바타와 대화형 아바타에 대한 유사성 평가가 달랐다는 점은 외모와 음성의 재현 품질을 버전별로 구분해 살펴볼 필요성을 보여준다.
  • 기업에서 질문에 계속 응답하는 편의성이 곧 저널리즘에서의 신뢰나 정서적 수용으로 이어지는 것은 아니며, 기자의 체험은 이 간극을 보여준다.

✅ 액션 아이템

  • 대화형 아바타의 활용 범위를 검토할 때 기사로 제한된 답변과 기자 개인의 지식·판단 재현을 구분.
  • Synthesia 도입 검토 시 대본 기반 영상 제작·배포, 대화형 Sessions, API 플랫폼의 용도를 비교.
  • 저널리즘의 아바타 활용 판단에 신뢰, 재현 품질, 심리적 수용성을 함께 반영.

❓ 열린 질문

  • 기사로 제한된 답변만 제공하는 대화형 아바타는 기자의 설명을 보완하는 데 얼마나 유용할까?
  • Synthesia의 대화형 Sessions와 API 플랫폼은 기업 교육에서 각각 어떤 활용에 적합할까?
  • 상시 응답의 편의성이 있어도 저널리즘의 신뢰와 아바타의 심리적 수용성을 확보할 수 있을까?

관련 문서

공통 태그와 주제 흐름을 기준으로 같이 보면 좋은 문서를 이어서 제안합니다.