PDF'den Markdown'a — ücretsiz, tarayıcıda, yükleme yok | nopa

Metin ve veri

PDF'den Markdown'a

Bir PDF bırakın; başlıkları, paragrafları ve listeleriyle Markdown alın — basılı her satır için bir satır değil. Birkaçını birden çevirip ZIP olarak indirin. Dosya bu tarayıcıdan çıkmaz.

Hemen deneyin — hesap gerekmez

Kaydet ve masaüstünde devam et

Önce sonucu buradan indirin veya kopyalayın. Dosyalar veya tam uygulama için masaüstünde devam edin.

  • Kalın ve listelerle basit notlar — yerelde saklanır
  • Masaüstünde devam ettiğinizde Dosyalar'a kaydedin
  • Tüm araçlar tek yerde — yeni sekme yok
Ücretsiz masaüstünü aç

İndirdikten sonra — Dosyalar veya tam uygulama için masaüstünde devam edin.

PDF'den Markdown'a neler yapabilir

Basılı satırlar değil, paragraflar

Bir PDF'te paragraf yoktur. Koordinatlara yerleşmiş glifler vardır ve okurun yapı olarak gördüğü her şey, bunların nerede durduğundan ve ne büyüklükte olduğundan çıkarılır. Bir PDF okuyucudan kopyalayın, tam olarak bunu alırsınız: sayfanın rastgele kırıldığı yerde sert bir satır sonu, kenarda bölünmüş her kelimenin ortasında bir tire ve cümlenin ortasında bir sayfa numarası. Böyle bir çıktı bir belgede kullanılamaz, bir istemde ise daha da beterdir. Burada satırlar geldikleri paragraflara geri birleştirilir, bölünmüş kelimeler yeniden yapıştırılır ve yinelenen üstbilgi ile altbilgiler — kırk kez tekrarlanan aynı başlık — atılır.

Başlıklar punto boyundan gelir

Bir PDF'te hiçbir şey «bu bir başlıktır» demez. Dediği şudur: bir satır 10 puntoluk metnin arasında 18 puntoyla dizilmiştir — o satır H1 olur, 13 puntoluklar H3 olur ve biraz daha büyük puntoyla dizilmiş uzun bir satır paragraf olarak kalır; koca bir girişin başlığa dönüşmesini engelleyen emniyet budur. Bu bir çıkarımdır ve yanıldığından çok daha sık isabet eder — ama bunun dosyanın taşıdığı bir yapı değil, bir çıkarım olduğunu bilmekte yarar var.

Yapıyormuş gibi davranmayacağı şeyler

Metin ve başlıklar, sayfa düzeni değil: iki sütunlu makaleler metin olarak okunur, şekiller, grafikler ve kutular yeniden kurulmaz. PDF bir taramaysa sayfaları harflerin görüntüsüdür ve alınacak metin yoktur — araç size boş bir dosya vermek yerine bunu söyler. Onu okumak OCR ister: 40 MB’lık bir model ve bambaşka bir vaat.

İlgili uygulamalar

Sorular

PDF'im bir yere yükleniyor mu?

Hayır. Tarayıcınızda, bu cihazda ayrıştırılır. Dosya hiçbir sunucuya gönderilmez ve biz onu görmeyiz.

Aynı anda birkaç dosya çevirebilir miyim?

Evet. İstediğiniz kadar ekleyin — her biri kendi `.md` dosyası olur ve tek bir düğme hepsini ZIP olarak indirir.

Taranmış PDF'imden neden hiçbir şey çıkmıyor?

Çünkü metin katmanı yok: sayfalar görüntü, okunacak karakter bulunmuyor. Araç boş bir dosya döndürmek yerine bunu söyler. Bir taramadan metin çıkarmak OCR gerektirir, o da burada yok.

Tablolar çevriliyor mu?

PDF'ten hayır. PDF'teki bir tablo, koordinatlara yerleşmiş çizgiler ve metindir; onu tablo diye işaretleyen hiçbir şey yoktur, bu yüzden hücreler metin olarak gelir. `.docx` dosyalarındaki tablolar ise gerçek Markdown tabloları olarak çevrilir.

Çevrimdışı çalışır mı?

Evet, sayfa bir kez açıldıysa. Dönüştürme tarayıcınızda çalışan koddur, gidip alınacak bir şey yoktur.