
AI 요금제를 보면 "100만 토큰당 얼마" 라고 적혀 있습니다. 대화가 길어지면 AI가 앞에 한 말을 잊어버립니다. 이 두 가지는 같은 개념 하나로 설명됩니다. 그리고 한국어 사용자에게는 이 개념이 특히 중요합니다 — 한국어는 영어보다 토큰을 훨씬 많이 먹기 때문입니다.
· 토큰 = AI가 글을 쪼개서 세는 조각 단위. 글자도 단어도 아닙니다
· 영어는 1토큰 ≈ 단어의 약 4분의 3. 고정 환산은 없습니다
· 한국어·일본어·태국어는 영어보다 토큰을 더 씁니다 — 같은 말을 해도 비쌉니다
· 요금은 입력과 출력 양쪽에 붙고, 보통 출력이 더 비쌉니다
· "AI가 까먹는" 현상도 토큰 문제입니다
토큰은 AI가 글을 써는 방식입니다
바게트를 떠올려 보세요. AI는 문장을 통째로 삼키지 않고 슬라이스로 썰어서 처리합니다. 그 한 조각이 토큰입니다.
다만 칼질이 균일하지 않습니다. 흔한 단어는 한 조각으로 끝나고, 드물거나 복잡한 단어는 여러 조각으로 쪼개집니다.
| 단어 | 쪼개지는 방식 | 토큰 수 |
|---|---|---|
| cat | cat | 1 |
| unbelievable | un / believ / able | 3 (예시) |
중요한 건 쪼개는 규칙(토크나이저)이 모델마다 다르다는 점입니다. 같은 문장이라도 어떤 AI에 넣느냐에 따라 토큰 수가 달라집니다. "1토큰 = 몇 글자"라는 고정 공식은 존재하지 않습니다.
한국어는 손해를 봅니다
여기가 한국 사용자에게 가장 중요한 대목입니다. 같은 뜻의 문장이라도 한국어는 영어보다 토큰을 더 많이 소모합니다. 일본어, 태국어도 마찬가지입니다.
이유는 단순합니다. AI 모델의 토크나이저는 영어 데이터를 기준으로 최적화된 경우가 많아서, 영어 단어는 통째로 한 토큰이 되는 반면 한글은 글자 단위나 그보다 잘게 쪼개지는 일이 흔합니다.
· 같은 내용을 물어도 API 비용이 더 나옵니다
· 컨텍스트 윈도우(한 번에 넣을 수 있는 양)에 더 적은 분량만 들어갑니다
· 긴 한국어 문서를 통째로 넣으면 영어 문서보다 먼저 잘립니다
최근 모델들은 이 격차를 상당히 줄였지만, 아직 사라지지는 않았습니다.
왜 토큰 단위로 과금할까
AI에게 비용이 발생하는 지점이 정확히 토큰이기 때문입니다. 그래서 API 요금표는 대부분 "100만 토큰당 $X" 형태입니다.
여기서 두 가지를 놓치기 쉽습니다.
- 입력에도 돈이 붙습니다. 긴 보고서를 넣고 두 줄 요약을 받았다면, 비용의 대부분은 당신이 넣은 쪽에서 나왔습니다.
- 출력 토큰이 보통 더 비쌉니다. 그래서 AI가 장황하게 답할수록 비용은 불균형하게 커집니다. "간결하게 답해줘" 한 줄이 요금을 줄입니다.
"AI가 까먹는" 것도 토큰 문제입니다
대화가 길어지면 AI가 처음에 준 지시를 무시하기 시작합니다. 성능이 나빠진 게 아닙니다. 컨텍스트 윈도우라는 한도를 넘어서면서 가장 오래된 내용부터 밀려나기 때문입니다.
해결책은 두 가지입니다.
- 핵심 제약을 주기적으로 다시 말해 주기. 첫 메시지가 살아 있다고 믿지 마세요.
- 깔끔한 요약으로 새 대화 시작하기. "지금까지 정한 것 요약해줘" → 그 요약을 새 창에 붙여넣기.
자세한 원리는 컨텍스트 윈도우란?에서 책상 비유로 설명했습니다.
토큰을 알면 뭐가 달라지나
| 얻는 것 | 내용 |
|---|---|
| 더 빠르고 싼 프롬프트 | 군더더기를 덜어내면 속도가 붙고 API 비용이 줄어듭니다 |
| 서비스 비교 기준 | 컨텍스트 윈도우 크기 + 100만 토큰당 가격. 이 두 숫자면 대부분 비교됩니다 |
| 긴 문서 처리 전략 | 섹션으로 쪼개 순차 요약. 토큰 예산도 아끼고 정확도도 올라갑니다 |
자주 묻는 질문
Q. 토큰 하나가 정확히 몇 글자인가요?
A. 고정 환산이 없습니다. 영어는 대략 단어의 0.75개 수준이고, 한국어는 그보다 불리합니다. 정확한 수치는 각 제공사가 공개한 토크나이저 도구로 직접 확인하세요.
Q. 내가 쓴 글의 토큰 수를 어떻게 확인하나요?
A. 대부분의 AI 제공사가 무료 토크나이저를 공개합니다. "모델명 + tokenizer"로 검색하면 나옵니다.
Q. 챗 화면만 쓰는데도 토큰을 알아야 하나요?
A. 요금 측면에서는 필요 없습니다. 정액제니까요. 하지만 컨텍스트 윈도우는 그대로 적용됩니다. 아주 긴 대화는 조용히 앞부분을 버리고 있다는 사실만 기억하세요.
함께 보면 좋은 글
- 컨텍스트 윈도우란? — AI가 잊어버리는 진짜 이유
- 무료 AI vs 유료 AI — 언제 결제할 가치가 있을까
- 소형 언어모델(SLM)이란? 내 PC에서 돌아가는 AI의 시대
- AI 리터러시란? 2030년 전에 갖춰야 할 6가지 능력
※ 토큰 환산과 요금은 모델·제공사마다 다르고 자주 바뀝니다. 정확한 수치는 해당 서비스의 공식 문서를 확인하세요.
'AI 교육' 카테고리의 다른 글
| 임베딩이란? — AI가 의미를 숫자로 바꾸는 법 (0) | 2026.09.03 |
|---|---|
| 컨텍스트 윈도우란? — AI가 앞 대화를 잊는 진짜 이유 (0) | 2026.09.03 |
| AI 리터러시란? 2030년 전에 갖춰야 할 6가지 능력 (0) | 2026.08.24 |
| AI로 영어 공부하는 법 — 효과 있는 활용 5가지와 피해야 할 함정 (0) | 2026.08.24 |
| 컨텍스트 엔지니어링이란? 프롬프트 다음에 온 필수 AI 스킬 (0) | 2026.08.24 |