Opus 5.5 loves to tell you 'this matters' (and other AI writing tells)
Quick Summary
Graphite 연구에 따르면 Opus 5.5와 Astra 등 최신 AI 모델은 엠대시 같은 유명한 문체 표식을 줄였지만, 모델·버전별로 인간 글보다 자주 사용하는 표현과 문장 구조는 여전히 남아 있다.
🖼️ 인포그래픽

🖼️ 4컷 인포그래픽

💡 한 줄 요약
Graphite 연구에 따르면 Opus 5.5와 Astra 등 최신 AI 모델은 엠대시 같은 유명한 문체 표식을 줄였지만, 모델·버전별로 인간 글보다 자주 사용하는 표현과 문장 구조는 여전히 남아 있다.
📌 핵심 요약
- 마케팅 기업 Graphite는 ChatGPT 출시 전 기사 10,000개와 그 요약을 바탕으로 AI 모델이 다시 쓴 글을 비교해, 인간 글보다 최소 2배 자주 등장하는 표현 13,000개를 AI 문체 표식으로 발견했다.
- Claude Opus 5.5에서는 ‘dependable’이 인간 표본보다 23배, ‘this matters’가 116배, ‘why X matters’가 92배 자주 등장했다. ‘it’s not X, it’s Y’는 피하지만 ‘is more than an X, it’s a Y’ 같은 대비 구문은 여전히 사용했다.
- OpenAI의 Astra는 ‘another dimension’, ‘may provide’, ‘can provide’를 선호했다. Graphite가 ‘교정적 프레이밍’이라고 부른 ‘not simply X’와 ‘rather than relying on X’ 같은 구문은 인간 글보다 100배 넘게 자주 나타났다.
- 엠대시 사용은 Opus 5.5에서 Opus 5보다 99% 줄었고, Astra에서는 인간 표본보다 88% 적었으며, Gemini 3.1 Pro에서는 거의 사라졌다.
- Graphite의 최고 AI 책임자 Greg Druck는 Claude의 단어 분포가 시간이 지날수록 인간에 가까워지는 반면 GPT는 멀어진다고 설명했다. 유명한 표식이 사라져도 전체 표식 수는 대체로 유지되며, Anthropic과 OpenAI의 자연스러운 문체 개선 주장에도 거대 모델의 모든 표현 습관을 통제하기는 어려울 수 있다는 가설을 제시했다.
🧩 주요 포인트
- Graphite의 빈도 비교 → AI 문체의 차이는 특정 유행어뿐 아니라 다양한 표현과 문장 구조에 걸쳐 나타남.
- Opus 5.5·Astra의 서로 다른 표현 습관 → 문체 표식은 모델과 버전을 구분해 해석할 필요가 있음.
- 엠대시 감소와 전체 표식 수 유지 → 알려진 표현의 제거와 인간에 가까운 문체의 구현은 별도로 평가할 문제임.
🧠 상세 정리
1. 유명한 표식이 사라진 뒤에도 남는 AI 문체
LLM이 생성한 글이 널리 퍼지면서 사람들은 AI가 쓴 문장을 알아볼 단서를 찾고 있다. 기사에 따르면 초기 단서로 꼽히던 엠대시와 ‘delve’ 같은 표현은 자취를 감췄지만, 연구자들은 모델이 반복적으로 사용하는 다른 문체 습관이 여전히 많다고 본다. 마케팅 기업 Graphite는 최신 모델들이 선호하는 단어와 구문을 조사하면서, 대비를 강조하는 문장 구조와 모델 버전마다 다른 특징을 확인했다. 연구에서 표식은 인간 글보다 AI 글에 최소 2배 자주 등장하는 표현으로 정의됐다. 이 기준에 해당하는 표현은 13,000개였으며, 기사는 특정한 몇 가지 유행어를 넘어 표식의 범위가 넓다는 점을 주요 발견으로 제시한다.
2. 비교 표본의 구성과 모델 계열별 변화
Graphite는 대규모 글쓰기 비교를 위해 ChatGPT 출시 전에 발행된 기사 10,000개를 인간 작성 대조군으로 사용했다. 이어 여러 AI 모델에 기사 요약을 제공하고 이를 바탕으로 기사를 다시 작성하게 했으며, 이 방식으로 원문에서 비롯되는 편향을 가능한 한 줄이려 했다. 인간과 각 모델의 대응 표본을 확보한 뒤에는 단어와 표현의 등장 빈도뿐 아니라 더 넓은 문장 구성 패턴도 비교했다. Graphite의 최고 AI 책임자 Greg Druck는 TechCrunch에 Claude 모델의 단어 분포가 시간이 지날수록 인간의 분포에 가까워지고 있다고 말했다. 반면 GPT 모델은 인간의 단어 분포에서 더 멀어지고 있다고 설명했으며, 이는 두 모델 계열의 변화 방향이 같지 않다는 연구 해석이다.
3. Opus 5.5의 대비 구문과 중요성 강조
Graphite는 Claude Opus 5.5의 가장 큰 표식으로 ‘dependable’을 지목했으며, 이 단어는 인간 표본보다 23배 자주 등장했다. Opus 5.5는 알려진 대비 구조인 ‘it’s not X, it’s Y’를 이제 피하지만, ‘is more than an X, it’s a Y’라는 다른 형태의 대비 문장은 여전히 사용하는 경향을 보였다. 기사는 특히 Opus가 어떤 것이 왜 중요한지 설명하는 표현을 즐겨 사용한다고 강조한다. ‘this matters’는 인간 글보다 116배, ‘why X matters’는 92배 자주 나타났다. 이 결과는 잘 알려진 문장 틀 하나가 줄어들어도 대비를 만들거나 중요성을 강조하는 다른 표현에서 해당 모델의 습관이 드러날 수 있음을 보여준다.
4. Astra의 완곡한 주장과 교정적 프레이밍
OpenAI의 Astra에서는 Opus 5.5와 다른 표현들이 두드러졌다. Astra는 논의 중인 주제의 ‘another dimension’을 설명하는 것을 선호하고, 어떤 행동의 이익을 말할 때 ‘may provide’나 ‘can provide’를 사용해 주장을 완곡하게 만드는 경향이 있었다. Graphite가 가장 큰 표식으로 꼽은 것은 ‘교정적 프레이밍’으로, 주제를 ‘not simply X’라고 정의하거나 ‘rather than relying on X’처럼 대안을 제시하는 구조다. 연구에 따르면 이러한 구문은 Astra가 생성한 글에서 인간 글보다 100배 넘게 자주 등장했다. 기사는 이를 모델별 문체 차이의 사례로 제시하며, 중요성을 반복해서 강조하는 Opus와 달리 Astra에서는 설명의 틀을 수정하거나 대안을 강조하는 방식이 두드러진다고 설명한다.
5. 엠대시 사용 감소와 지속되는 표식
Graphite의 표본에서는 주요 AI 연구소들이 모델의 엠대시 과용에 대한 지적에 대응한 것으로 보인다. Opus 5.5의 엠대시 사용은 Opus 5보다 99% 줄었으며, Astra는 인간 표본보다 88% 적게 사용했다. Gemini 3.1 Pro는 글에서 엠대시를 거의 완전히 없앤 것으로 나타났다. 그러나 Graphite는 개별 표식이 바뀌더라도 전체 표식 수는 대체로 유지되고 있다고 설명한다. Druck는 잘 알려진 표식이 제거되는 동안 다른 표식이 생겨나며, 모델 버전마다 고유한 표식이 있다고 말했다. 따라서 기사는 엠대시의 감소라는 구체적인 변화와 AI 특유의 표현 습관이 전반적으로 줄어드는지를 구분해 다룬다.
6. 자연스러운 글쓰기 주장과 통제의 한계
기사는 연구소들이 인간처럼 자연스럽게 쓰는 능력을 강조하는 상황에서도 문체 표식이 지속된다는 점에 주목한다. Anthropic은 Opus 5.5 출시 당시 이전 모델보다 더 자연스럽게 소통하며, 초기 사용자들이 글을 더 명확하고 따라가기 쉽다고 평가했다고 밝혔다. OpenAI도 GPT-6 버전의 Sol과 Luna를 출시하면서 더 명확한 표현, 더 적은 전문용어, 더 적은 어색한 문구를 기대할 수 있다고 주장했다. 하지만 Druck는 연구소들이 특징적인 구문과 표현을 완전히 제거할 수 있는 정도에 회의적이다. 그는 수십억 개의 매개변수를 가진 거대 모델에 대해 실행할 수 있는 테스트 수는 유한하므로 일부 습관이 검사를 빠져나갈 수 있다고 설명했다. 이는 연구소의 통제 능력이 예상보다 제한적일 수 있다는 그의 일반적 가설이며, 기사에서도 확정된 결론으로 제시하지 않는다.
🧾 핵심 주장 / 시사점
- Graphite의 표식은 인간 글과 AI 글 사이의 상대적 빈도로 정의되므로, 기사에 제시된 수치는 표현 사용의 통계적 차이를 나타낸다.
- Opus 5.5와 Astra의 사례는 익숙한 표현 하나를 없애더라도 다른 구문에서 모델 고유의 문체가 드러날 수 있음을 시사한다.
- Anthropic과 OpenAI가 주장하는 명확성·자연스러움의 개선은 전체 문체 표식이 감소했다는 주장과 구분해 해석할 필요가 있다.
✅ 액션 아이템
- Opus 5.5의 ‘this matters’와 Astra의 ‘교정적 프레이밍’을 모델별 문체 검토에 반영한다.
- 엠대시 사용 감소와 전체 표식 수 유지의 의미를 구분해 문체 개선 주장을 검토한다.
- Claude와 GPT의 단어 분포 변화는 Graphite의 비교 결과와 Greg Druck의 해석을 근거로 살핀다.
❓ 열린 질문
- Opus 5.5와 Astra에서 확인된 표현 습관은 이후 버전에서도 유지될까?
- Claude는 인간의 단어 분포에 가까워지고 GPT는 멀어지는 변화가 앞으로도 이어질까?
- Anthropic과 OpenAI는 자연스러운 문체를 개선하면서 전체 문체 표식 수도 줄일 수 있을까?