Текст и данные
Посчитать токены
Вставьте промпт или документ и увидите точное число токенов — от настоящего токенизатора, а не от прикидки «символы делить на четыре». Таблица снизу скажет, влезет ли. Текст никуда не загружается.
Сохранить и продолжить на рабочем столе
Скачайте или скопируйте результат прямо здесь. В рабочем столе он сохранится в Файлы, а инструмент откроется в полной версии.
- Простые заметки с жирным и списками — всё локально
- Сохраните в Файлы, когда продолжите на рабочем столе
- Все инструменты рядом — без новых вкладок
После скачивания — продолжите на рабочем столе: Файлы или полная версия.
Что умеет Посчитать токены
Точно там, где это возможно, и помечено там, где нет
OpenAI публикует свои токенизаторы, поэтому счёт для GPT-5, GPT-4.1, GPT-4o и более старых GPT-4 и 3.5 точный — тот самый словарь байтовых пар, что использует API, только здесь. Больше не публикует никто. Поэтому строки Claude, Gemini и Llama помечены знаком ≈ и считаются словарём OpenAI вместо их собственного: на обычной прозе это укладывается в несколько процентов. Большинство счётчиков печатают эти числа вообще без пометки — в этом и разница между оценкой и утверждением.
Почему «символы делить на четыре» вас подводит
Это правило откалибровано на английской прозе и больше ни на чём. Токенизатор работает с парами байтов: частое английское слово — это один токен, редкое — три, а русский, греческий, иврит или тайский нередко стоят по токену на символ и хуже. Один и тот же абзац на одном языке даёт вдвое больше токенов, а на другом — вдвое меньше. Код, JSON и длинные ссылки ломают правило в другую сторону. А если вы у самого лимита, разница между прикидкой и настоящим числом — это ровно та часть, которая решает, пройдёт запрос или нет.
Словарь качается один раз, и больше ничего никуда не уходит
Токенизатор весит около мегабайта и загружается при первом наборе, потом кешируется, — поэтому счётчики символов и слов показываются мгновенно, пока он едет, а при следующем заходе всё сразу. Ваш текст в этом не участвует: он токенизируется здесь, в этой вкладке, и никуда не отправляется. Ради этого локальный счёт и нужен — чтобы не вставлять конфиденциальный промпт на чужой сервер ради замера.
Похожие приложения
Текст и данные
Посчитать символы
Вставьте или наберите текст — счётчик обновляется на ходу: символы…
Текст и данные
Посчитать слова
Вставьте или наберите текст — количество слов обновляется вживую…
Текст и данные
PDF в Markdown
Бросьте PDF и получите Markdown с заголовками, абзацами и списками — а…
Текст и данные
Удалить скрытые символы
Вставьте текст — и невидимая часть станет видимой: символы нулевой…
Текст и данные
Заметки
Простые заметки без регистрации
Вопросы
Текст куда-то загружается?
Нет. Токенизатор работает в вашем браузере, на этом устройстве. Текст не уходит на сервер, и мы его не видим.
Какой токенизатор используется?
o200k_base для GPT-5, GPT-4.1 и GPT-4o и cl100k_base для GPT-4 Turbo, GPT-3.5 и эмбеддингов OpenAI — те же словари, что и у самих моделей.
Числа для Claude и Gemini точные?
Нет, и именно поэтому они помечены знаком ≈. Ни тот, ни другой вендор токенизатор не публикует, поэтому эти строки считаются словарём OpenAI. На обычной прозе расхождение в несколько процентов; текст, который лёг ровно на лимит, стоит считать рискованным.
Почему в первый раз число появляется не сразу?
Потому что сам словарь весит около мегабайта и качается один раз, а дальше лежит в кеше браузера. Символы и слова считаются мгновенно, без всякой загрузки.
Он считает токены в коде и JSON?
Да, токенизатор один и тот же. Именно на коде правило «символы на четыре» врёт сильнее всего.