PDF'ten Word'e Dönüşümünüz Neden Çalışmıyor
Başarısız PDF'ten Word'e dönüşümlerin çoğu beş nedenden birine iner ve her birinin çözümü farklıdır. Hangisine takıldığınızı yaklaşık on saniyede nasıl anlayacağınız burada.
Önce şu on saniyelik testi yapın
PDF'i açın ve kopyalayacakmış gibi fareyle bir cümle seçmeyi deneyin.
Metin seçilebiliyorsa PDF'iniz gerçek metin içeriyor ve düzgün her dönüştürücü çıkarabilir — sorununuz aşağıdaki düzen meselelerinden biridir. Hiçbir şey seçilmiyorsa ya da tüm sayfa tek blok olarak seçiliyorsa, PDF'iniz bir belgenin resmidir ve sıradan hiçbir dönüştürücü okuyamaz. Bu tek test, sayfanın hangi yarısının size uyduğunu söyler.
Neden 1: taranmış bir PDF
Açık ara en yaygın neden budur. Tarayıcıdan, telefon kamerasından veya fakstan çıkan PDF sayfa fotoğrafları içerir, metin değil. Çıkarılacak bir şey yoktur; boş belge ya da görsellerden oluşan sayfalar alırsınız.
Çözüm OCR'dır — optik karakter tanıma — harflerin resimlerini okuyup metni yeniden kurar. Google Drive bunu ücretsiz yapar: PDF'i yükleyin, sağ tıklayın, Google Dokümanlar ile Aç'ı seçin; dosya OCR'lanır. Adobe Acrobat ve OneNote da yapabilir. El yazısında, sıra dışı yazı tiplerinde ve kötü taramalarda hata bekleyin.
Neden 2: düzen dağılıyor
Metnin tamamı orada ama sütunlar iç içe geçmiş, tablolar metin yığınına dönmüş, görseller kayıp. Bu bir hata değil, formatın doğasıdır.
PDF, her karakterin sayfada nerede durduğunu kaydeden bir nihai çıktı formatıdır. "Bu iki sütunlu bir düzen" ya da "bu bir tablo" bilgisini kaydetmez — o yapı PDF üretilirken atılmıştır. Dönüştürücüler geri tahmin etmek zorundadır ve karmaşık düzenler tahminin çuvalladığı yerdir.
Kelimeler gerekiyorsa temiz, biçimsiz metni kabul edin ve düzeni Word'de yeniden kurun. Görünüm gerekiyorsa hiç dönüştürmeyin — PDF'te kalın.
Neden 3: PDF parola korumalı
Şifreli PDF'leri dönüştürücüler açamaz ve çoğu, gerçek nedeni söylemek yerine belirsiz bir hata verir. İki tür koruma vardır: dosyanın okunmasını tümden engelleyen açma parolası ve okumaya izin verip kopyalama ile düzenlemeyi yasaklayan izin parolası. İkisi de dönüşümü engelleyebilir.
Parolayı biliyorsanız dosyayı açın, yeni bir PDF'e yazdırın ve o kopyayı dönüştürün.
Neden 4: dosya araç için çok büyük
Her çevrimiçi dönüştürücünün yükleme sınırı vardır ve çoğu, aşılan sınırı genel bir hata olarak bildirir. PDF'iniz onlarca megabaytsa — taramalarda çok yaygın — daha küçük bölümlere ayırıp her birini dönüştürmeyi deneyin ya da boyut sınırı olmayan bir masaüstü aracı kullanın.
Neden 5: metin anlamsız karakterler olarak çıkıyor
Bazen çıkarılan metin doğru konumlarda gerçek karakterlerdir ama anlamsızdır — kelimelerin yerinde rastgele harfler. Bu, PDF'in doğru karakter eşlemesi olmadan bir yazı tipi alt kümesi gömmesiyle olur: dosya hangi şekli çizeceğini bilir ama hangi karakteri temsil ettiğini bilmez.
Bunu düzeltmek gerçekten zordur; eski LaTeX araçlarının ve bazı tasarım yazılımlarının ürettiği PDF'lerde daha yaygındır. Pratik çözüm OCR'dır: bozuk metin katmanını yok sayar ve görüntülenen sayfayı okur.
İyi bir dönüşümden ne beklemeli
Her şey çalıştığında bile PDF'i Word'e çevirmek bir yeniden inşadır, geri çevirme değil. Metin tabanlı bir PDF'te gerçekçi sonuç: tüm paragraflar mevcut ve düzenlenebilir, başlıklar kabaca yerinde, basit biçimlendirme korunmuş — sütunlar, tablolar ve hassas boşluklar elle onarım ister.
Filembly'nin PDF'den Word'e dönüştürücüsü metni çıkarır, temiz düzenlenebilir paragraflar halinde yeniden kurar ve bir PDF'te çıkarılabilir metin olmadığında boş dosya vermek yerine bunu açıkça söyler.