AI 토큰 계산기와 컨텍스트 수용 여부

아무 텍스트나 붙여넣으면 대략 몇 토큰이 될지, 주어진 컨텍스트 윈도우에 들어가는지, 본인 API 요금으로 얼마일지 확인할 수 있습니다. 전부 브라우저에서 돌아가며 텍스트는 절대 업로드되지 않습니다.

아무것도 이 페이지를 벗어나지 않습니다. 모델에 넣어 볼까 하는 문서로 한번 시험해 보세요.
0 추정 토큰 수 ±10~15% — 추정 방식은 아래에서
글자 수0
단어0
토큰당 글자 수낮을수록 밀도 높은 글
대략적인 읽기 시간

컨텍스트 창에 들어가나요?

컨텍스트 윈도우입력한 텍스트들어가나요?

컨텍스트 윈도우는 입력한 내용과 모델의 답변, 그리고 앱이 뒤에서 덧붙이는 것들(시스템 프롬프트, 검색해 온 문서, 대화 기록)이 나눠 씁니다. 여유를 남기세요 — 윈도우를 끝까지 채우면 답이 잘립니다.

비용은 얼마일까?

입력 비용
출력 비용
합계
사용 중인 제공사의 최신 가격 페이지를 보고 요금을 직접 입력하세요. 가격은 일부러 하드코딩하지 않습니다. 모델 가격은 자주 바뀌고, 오래된 숫자가 적혀 있는 것보다는 아예 없는 편이 낫습니다. 다음에서 확인하세요: OpenAI, Google, xAI 또는 DeepSeek.
이 추정값을 계산하는 방식(그리고 정확하지 않은 이유)

진짜 토큰화는 모델 계열마다 다른 BPE 어휘 사전을 텍스트에 적용하는 과정이라, "진짜" 개수도 모델마다 다릅니다. 이걸 브라우저에서 제대로 하려면 계열마다 수 메가바이트짜리 사전을 함께 내려받아야 하는데, 대략만 알면 되는 숫자 하나 때문에 페이지가 느려집니다.

대신 이 도구는 글자 수와 단어 수를 바탕으로 공백·문장부호·숫자에 가중치를 준 추정기를 씁니다. 보통의 영어 산문이라면 대략 10~15% 안에 들어옵니다. 알려진 편향이 둘 있습니다. 코드와 문장부호가 많은 글은 추정보다 조밀하게 토큰화되고, 비라틴 문자(중국어, 일본어, 아랍어, 힌디어)는 영어보다 글자당 토큰을 훨씬 많이 씁니다 — 흔히 2~3배입니다.

청구용으로 정확한 값이 필요하다면 제공사의 토크나이저 엔드포인트를 쓰세요. '이게 들어갈까', '대충 얼마일까' 정도라면 추정값으로 충분합니다.

토큰이란 실제로 무엇인가

모델은 글자도 단어도 읽지 않습니다 — 토큰을 읽고, 토큰은 그 둘 사이 어딘가의 덩어리입니다. 흔한 단어는 대개 한 토큰이고, 길거나 드문 단어는 여럿으로 쪼개집니다. 「Unbelievable」은 세 토큰일 수 있고 「the」는 하나입니다. 영어 산문에서 한 토큰은 평균 네 글자쯤, 곧 한 단어의 4분의 3가량입니다.

값도 한도도 전부 토큰 단위입니다. 보내는 것, 돌아오는 것, 그리고 모델이 한 번에 담을 수 있는 양.

내 글이 생각보다 밀도가 높은 이유

컨텍스트 윈도우 ≠ 내 예산

컨텍스트 윈도우가 100만 토큰이라고 해서 100만 토큰을 다 보내야 하는 건 아닙니다. 아주 긴 입력에서는 중간 부분으로 갈수록 어텐션 품질이 떨어지고, 지연 시간이 늘고, 비용은 길이에 비례해 늘어납니다. 관련 대목만 끌어오는 검색(retrieval)이 윈도우를 꽉 채우는 것보다 대체로 낫고, 비용도 적게 듭니다.

자주 묻는 질문

이 계산기는 얼마나 정확한가요?

일반적인 영어 텍스트라면 오차가 대략 10~15% 이내입니다. 코드와 비라틴 문자는 추정치보다 높게 나옵니다. 정확한 청구 수치는 사용하는 제공사의 토크나이저로 확인하세요.

제 텍스트가 어딘가로 업로드되나요?

아니요. 계산은 브라우저 안에서 이뤄집니다. 요청도, 로그도, 저장도 없습니다.

모델 가격은 왜 안 보여주나요?

가격은 바뀌기 마련이고, 철 지난 가격을 그럴듯하게 보여주는 건 아예 안 보여주는 것보다 나쁘기 때문입니다. 사용 중인 제공사의 현재 요금을 입력하면 계산은 도구가 대신합니다.

이미지와 오디오도 토큰을 쓰나요?

예 — 멀티모달 입력도 토큰으로 환산되며, 환산 비율은 제공사와 해상도에 따라 다릅니다. 이 도구는 텍스트만 다룹니다.

관련: RAG란 무엇인가? · 작업별로 어떤 AI 모델을 쓸까 · 무료 도구 전체