PDFIntact

Ambil tabel dan teks dari PDF Anda, apa adanya

Menyalin dari PDF ini menghasilkan teks kacau

Anda memilih teks di dalam PDF, menyalinnya, menempelkannya — lalu muncul deretan karakter tak terbaca dari sistem tulisan yang sama sekali lain. Di layar halamannya tampak benar; rusaknya justru pada saat disalin.

Sebabnya, font yang tertanam dalam PDF itu kehilangan tabel yang memetakan tiap glif ke kode karakter — ToUnicode CMap. Untuk menampilkan cukup perintah «gambar bentuk ini», jadi halaman tetap tampil benar tanpanya. Menyalin membutuhkan kode karakter, dan di situlah rantainya putus. Ini lazim pada artikel jurnal, dokumen pemerintah, dan berkas dari perangkat lunak penataan huruf lama.

Karakternya tidak rusak. Di halaman itu tergambar bentuk yang terbaca. Karena itu membaca ulang halamannya sebagai gambar memulihkan teksnya. Mengganti font atau menempel di aplikasi lain tidak menolong — informasinya sudah hilang pada saat penyalinan.

Coba sekarang

Periksa dengan PDF Anda sendiri

Pemeriksaan berjalan sepenuhnya di dalam peramban Anda. Berkas tidak pernah diunggah dan akun pun tidak perlu. Sebelum membayar, Anda sudah bisa melihat berapa halaman, tabel, dan gambar yang bisa diambil.

Contoh

実際のPDFからコピーした文字列

下は官公庁の資料からコピーした実物です。左が化けたもの、右が復元したものです。左をコピーして、お使いのエディタに貼ってみてください。同じ結果になります。

コピーした結果

ᆅ᪉බඹᅋయ࡟࠾ࡅࡿ᭩㠃つไࠊᢲ༳ࠊᑐ㠃つไࡢぢ┤ࡋ࡟ࡘ࠸࡚

PDFIntact で取り出した結果

地方公共団体における書面規制、押印、対面規制の見直しについて

お手元の文字列で判定する

コピーした文字列を貼ると、それがこの種類の文字化けかどうかをその場で判定します。PDFを用意しなくても、コピーした結果だけで確かめられます。

判定はこのブラウザの中だけで行っています。入力した文字列はどこにも送信されません。

Pertanyaan yang sering diajukan

Why does copying from a PDF produce garbled text?
Because the fonts embedded in the file are missing the table (the ToUnicode CMap) that says which character each glyph shape represents. The page displays correctly, but copying yields different characters. The text is not damaged — only the mapping is missing — so reading the pages as images recovers it.
Can the text be recovered from a garbled PDF?
Yes. PDFIntact reads the pages back as images and recovers the text with character recognition. The check runs entirely in your browser before you pay, so you can confirm it works on your file. Nothing is uploaded.
Will pasting into Word fix it?
No. The character codes are already lost at the point of copying, so the same corruption appears wherever you paste. Changing fonts does not help either.
How much does it cost?
A one-off charge based on page count: 160 JPY for 1–10 pages, 300 for 11–30, 550 for 31–60, 850 for 61–100 and 1,500 for 101–200. No account required. The check itself is free.

Periksa PDF untuk semua gejala sekaligusApa isi tiap format