Metin ve veri
Token sayın
Bir istem ya da belge yapıştırın ve kesin token sayısını görün — «karakteri dörde böl» tahmininden değil, gerçek tokenlayıcıdan. Alttaki tablo sığıp sığmadığını söyler. Metniniz yüklenmez.
Kaydet ve masaüstünde devam et
Önce sonucu buradan indirin veya kopyalayın. Dosyalar veya tam uygulama için masaüstünde devam edin.
- Kalın ve listelerle basit notlar — yerelde saklanır
- Masaüstünde devam ettiğinizde Dosyalar'a kaydedin
- Tüm araçlar tek yerde — yeni sekme yok
İndirdikten sonra — Dosyalar veya tam uygulama için masaüstünde devam edin.
Token sayın neler yapabilir
Mümkün olan yerde kesin, olmayan yerde işaretli
OpenAI tokenlayıcılarını yayımlıyor; bu yüzden GPT-5, GPT-4.1, GPT-4o ile eski GPT-4 ve 3.5 için sayı kesindir — API'nin kullandığı bayt çifti sözlüğünün ta kendisi, burada çalışıyor. Başka kimse yayımlamıyor. Bu nedenle Claude, Gemini ve Llama satırları ≈ ile işaretli ve kendi sözlükleri yerine OpenAI'ninkiyle sayılıyor; sıradan düzyazıda bu birkaç yüzdelik içinde kalır. Çoğu sayaç bu rakamları hiçbir işaret koymadan basar — tahminle iddia arasındaki fark tam da budur.
«Karakteri dörde böl» sizi neden yanıltır
Bu kestirme kural yalnızca İngilizce düzyazıya göre ayarlanmıştır. Tokenlayıcı bayt çiftleriyle çalışır: sık kullanılan bir İngilizce kelime tek token, seyrek olanı üç tokendir; Rusça, Yunanca, İbranice ya da Tayca ise çoğu zaman karakter başına bir token, hatta daha fazlasına mal olur. Aynı paragraf bir dilde iki kat, başka bir dilde yarısı kadar tutabilir. Kod, JSON ve uzun bağlantılar kuralı ters yönde bozar. Sınıra yakınsanız, kestirme kuralla gerçek sayı arasındaki fark tam da çağrının geçip geçmeyeceğini belirleyen kısımdır.
Sözlük bir kez iner, başka hiçbir şey buradan çıkmaz
Tokenlayıcı yaklaşık bir megabayttır; ilk yazdığınızda indirilir, sonra önbelleğe alınır — bu yüzden o gelene kadar karakter ve kelime sayıları anında görünür, sonraki ziyaret ise anlıktır. Metniniz bunun parçası değildir: burada, bu sekmede tokenlara ayrılır ve hiçbir yere gönderilmez. Gizli bir istemi ölçtürmek için başkasının sunucusuna yapıştırmak yerine yerelde saymanın bütün sebebi budur.
İlgili uygulamalar
Metin ve veri
Karakter say
Metni yapıştırın, karakter sayısı anında görünsün — boşluklu ve…
Metin ve veri
Kelime say
Metni yapıştırın; kelime, karakter ve okuma süresi yazdıkça sayılsın.
Metin ve veri
PDF'den Markdown'a
Bir PDF bırakın; başlıkları, paragrafları ve listeleriyle Markdown…
Metin ve veri
Gizli karakterleri kaldır
Metni yapıştırın; görünmeyen kısım görünür hale gelsin: sıfır…
Metin ve veri
Not yaz
Metin yazın, kalın ve listelerle biçimlendirin — indirin veya…
Sorular
Metnim bir yere yükleniyor mu?
Hayır. Tokenlayıcı tarayıcınızda, bu cihazda çalışır. Metin hiçbir sunucuya gönderilmez ve biz onu görmeyiz.
Hangi tokenlayıcı kullanılıyor?
GPT-5, GPT-4.1 ve GPT-4o için o200k_base; GPT-4 Turbo, GPT-3.5 ve OpenAI gömmeleri için cl100k_base — modellerin kendi kullandığı sözlüklerin aynısı.
Claude ve Gemini sayıları kesin mi?
Hayır, ≈ işaretini bu yüzden taşıyorlar. İki sağlayıcı da tokenlayıcı yayımlamıyor, bu yüzden o satırlar yerine OpenAI'ninkiyle sayılıyor. Sıradan düzyazıda sapma birkaç yüzde; tam sınıra oturan bir metni riskli sayın.
İlk seferde sayı neden biraz gecikiyor?
Çünkü sözlüğün kendisi yaklaşık bir megabayt; bir kez indirilir ve sonrasında tarayıcınız saklar. Karakter ve kelimeler ise hiçbir şey indirmeden anında sayılır.
Kod ve JSON için token sayıyor mu?
Evet, tokenlayıcı aynı. Zaten «karakteri dörde böl» kuralının en çok saptığı yer koddur.