Skip to content

Foto ke Teks: Ekstrak Teks dari Gambar Apa Pun, Gratis

Jatuhkan file di sini — tempel, seret, atau klik untuk menelusuri

.png,.jpg,.jpeg,.webp,.bmp

Diproses di perangkatmu — tidak ada yang diunggah. Verifikasi di tab jaringan.

Alat ini menarik kata-kata dari sebuah gambar dan mengembalikannya sebagai teks polos yang bisa diedit dan disalin. Jatuhkan sebuah foto, screenshot, halaman hasil scan, atau gambar sebuah dokumen, dan karakternya kembali sebagai teks yang bisa diseleksi dalam beberapa detik. Gratis, tanpa daftar, dan tanpa langkah unggah.

Bedanya ada pada di mana prosesnya berlangsung. Pengenalan karakter optik (OCR) berjalan sepenuhnya di dalam tab browsermu. Saat pertama kali kamu memakainya, model pengenalan kecil (sekitar 25 MB) diunduh dan tersimpan di perangkatmu; setelah itu, setiap gambar yang kamu konversi dibaca secara lokal. Fotomu tidak pernah dikirim ke server — kamu bisa membuktikannya sendiri di tab network browser, dan kami jelaskan caranya di bawah.

Alat ini dibuat untuk teks cetak dan ketikan: struk, screenshot, halaman buku, formulir, slide, label produk, dan kartu nama. Bahasa Inggris, Spanyol, dan Indonesia didukung saat peluncuran, dengan lebih banyak bahasa menyusul. Tulisan tangan adalah satu-satunya hal yang belum bisa dikerjakannya dengan baik, dan kami terus terang soal batas itu lebih jauh di halaman ini.

Cara kerjanya

  1. 01

    Tambahkan gambarmu

    Seret sebuah foto, screenshot, atau hasil scan ke halaman, atau klik untuk menelusuri file-mu. JPG, PNG, dan WebP semuanya bisa langsung, dan foto HEIC dari iPhone pun ditangani. Kamu bisa menambahkan beberapa gambar sekaligus dan semuanya akan dibaca berurutan.

  2. 02

    Biarkan OCR berjalan di browsermu

    Model pengenalan membaca gambar di perangkatmu sendiri. Pada percobaan pertama, ia diunduh sekali (sekitar 25 MB) lalu tersimpan di cache, jadi setiap konversi berikutnya mulai seketika. Tidak ada yang diunggah — byte gambarnya tak pernah keluar dari tab.

  3. 03

    Salin atau unduh teksnya

    Teks hasil ekstraksi muncul di panel yang bisa diedit. Salin langsung ke clipboard, atau unduh sebagai file .txt polos. Kamu bisa memperbaiki satu karakter nyasar atau menata ulang baris sebelum menyimpan.

Cara kerja foto ke teks di browser

Kebanyakan konverter online mengunggah gambarmu ke server, menjalankan OCR di sana, lalu mengirim teksnya kembali. Yang ini tidak. Model pengenalannya — mesin OCR modern yang ringkas dari keluarga PaddleOCR — diunduh ke browsermu satu kali lalu berjalan secara lokal di sebuah worker latar setiap kali kamu mengonversi gambar.

Desain itu punya dua konsekuensi praktis. Pertama, privasi bersifat struktural, bukan sekadar janji: karena konversi terjadi di tab-mu, tidak ada server yang pernah menyimpan salinan gambarmu. Tidak ada apa pun tentang file itu — bukan pikselnya, bukan nama file-nya — yang dikirimkan. Kedua, ia tetap bekerja secara offline begitu model tersimpan di cache, jadi struk atau screenshot yang baru ditangkap tetap terkonversi bahkan tanpa koneksi.

Kamu tak perlu percaya begitu saja. Buka developer tools browsermu, pindah ke tab Network, lalu konversi sebuah gambar. Kamu akan melihat file model terunduh pada percobaan pertama (dan dimuat dari cache sesudahnya), tapi kamu tidak akan melihat gambarmu diunggah ke mana pun. Byte-nya tetap di perangkat.

Screenshot ke teks: tarik kata dari tangkapan layar apa pun

Screenshot adalah hal yang paling sering diproses orang lewat alat ini, dan juga yang paling baik dibacanya. Tangkapan layar itu tajam, terang merata, dan dirender pada kerapatan piksel asli, yang nyaris ideal sebagai masukan untuk OCR.

Pekerjaan screenshot ke teks khas yang ditangani ini dengan mulus:

  • Menyalin pesan error atau stack trace yang dirender program sebagai gambar atau tak bisa diseleksi
  • Mengangkat teks dari chat, unggahan media sosial, atau utas komentar
  • Mengambil kode, perintah, atau potongan konfigurasi dari video atau slide
  • Menarik angka dari dashboard, label grafik, atau tangkapan spreadsheet
  • Mengubah screenshot PDF atau halaman berbayar kembali jadi teks yang bisa diedit

Di macOS pakai Shift-Command-4, di Windows pakai Snipping Tool (Windows-Shift-S), lalu jatuhkan tangkapannya langsung ke halaman ini. Karena teks dalam screenshot sudah tajam, akurasinya biasanya nyaris sempurna.

Yang dibaca dengan baik — dan yang tidak

Jujur soal batasannya menghemat waktumu, jadi inilah gambaran sesungguhnya.

Terbaca sangat baik: teks cetak dan ketikan hampir jenis apa pun — buku, struk, faktur, formulir, label, rambu, dek slide, dan screenshot. Foto jernih dari halaman dokumen juga bagus, asal teksnya fokus dan cukup lurus.

Kesulitan: tulisan tangan. Tulisan sambung dan catatan tangan santai benar-benar sulit bagi OCR di browser, dan hasilnya akan buruk — alat ini bukan yang tepat untuk itu. Kami sedang membangun alat khusus tulisan-tangan-ke-teks yang memakai model berbeda dan lebih berat persis untuk kasus ini; segera hadir.

Beberapa tips untuk hasil lebih baik: foto dokumen tegak lurus alih-alih menyudut, masukkan seluruh blok teks ke dalam bingkai, dan hindari silau serta bayangan. Kalau sebuah foto buram, ambil ulang — masukan yang lebih tajam mengalahkan pengeditan sebanyak apa pun. Teks yang sangat kecil atau berkontras sangat rendah bisa kehilangan karakter, jadi potong dekat kalau bisa.

Bahasa dan format gambar yang didukung

Bahasa saat peluncuran: Inggris, Spanyol, dan Indonesia. Mesinnya mengenali karakter beraksara Latin, aksen, dan tanda baca yang dipakai lintas bahasa ini, jadi tilde dan vokal beraksen bahasa Spanyol muncul dengan benar. Lebih banyak bahasa sedang direncanakan, dan alat ini akan mengambil model yang tepat secara otomatis begitu ditambahkan.

Format gambar: JPG/JPEG, PNG, dan WebP dibaca langsung. HEIC/HEIF — format yang dipakai iPhone secara bawaan — juga didukung, jadi kamu bisa menjatuhkan foto langsung dari galeri tanpa mengonversinya dulu. Untuk dokumen banyak halaman, PDF biasanya lebih pas ketimbang gambar; pakai alat PDF ke teks kami untuk itu.

Tidak ada batas ukuran file yang dipaksakan server, karena tidak ada server di jalurnya — batas praktisnya adalah memori perangkatmu. Foto dan screenshot sehari-hari jauh di bawah batas itu.

Pertanyaan yang sering diajukan

Apakah gambar saya benar-benar privat, dan bagaimana memverifikasinya?
Ya. OCR berjalan sepenuhnya di browsermu, jadi gambarmu tak pernah diunggah ke server mana pun. Kamu bisa membuktikannya langsung: buka developer tools browsermu, masuk ke tab Network, lalu konversi sebuah gambar. Kamu akan melihat model pengenalan terunduh pada percobaan pertama dan dimuat dari cache sesudahnya, tapi kamu tak akan pernah melihat gambarmu dikirim ke mana pun. Byte-nya tetap di perangkatmu.
Format gambar apa saja yang bisa saya konversi ke teks?
JPG/JPEG, PNG, dan WebP bisa langsung. HEIC dan HEIF — format foto bawaan di iPhone — juga didukung, jadi kamu bisa menjatuhkan gambar langsung dari galeri tanpa mengonversinya dulu. Kalau kamu punya hasil scan banyak halaman, PDF biasanya pilihan lebih baik; alat PDF ke teks kami menangani itu. Kamu bisa menambahkan beberapa gambar sekaligus dan semuanya akan dibaca berurutan.
Seberapa akurat ekstraksi teksnya?
Untuk teks cetak dan ketikan — struk, screenshot, halaman buku, formulir, slide — akurasinya sangat tinggi, sering nyaris sempurna pada masukan yang bersih dan tajam. Screenshot terbaca sangat baik karena pikselnya tajam. Akurasi menurun dengan buram, silau, kemiringan berat, atau teks sangat kecil, jadi gambar yang lurus, terang, dan fokus memberi hasil terbaik. Tulisan tangan adalah pengecualian utama dan belum ditangani dengan baik.
Bahasa apa saja yang didukung alat foto ke teks ini?
Saat peluncuran ia mendukung Inggris, Spanyol, dan Indonesia, termasuk karakter beraksen dan tanda baca yang dipakai bahasa-bahasa itu, jadi tilde dan vokal beraksen bahasa Spanyol muncul dengan benar. Alat ini memuat model pengenalan yang tepat secara otomatis. Lebih banyak bahasa ada di peta jalan dan akan tersedia tanpa mengubah cara kamu memakai halaman ini — cukup jatuhkan gambarmu dan konversi.
Bagaimana cara menyalin teks dari foto di iPhone atau Android saya?
Buka halaman ini di browser ponselmu, ketuk untuk menambahkan foto dari galeri (atau ambil satu di tempat), dan teksnya diekstrak langsung di perangkat. Foto HEIC iPhone bisa tanpa konversi apa pun. Saat teks muncul di panel yang bisa diedit, ketuk Salin untuk menaruhnya di clipboard, atau unduh sebagai file .txt. Tidak ada yang diunggah dari ponselmu.
Bisakah saya mengonversi beberapa gambar sekaligus?
Ya. Tambahkan beberapa gambar bersamaan dan alat ini membacanya satu per satu, mengembalikan teks untuk masing-masing. Karena semuanya berjalan secara lokal, tidak ada waktu tunggu unggah per file — biaya utamanya adalah perangkatmu memproses tiap gambar, yang biasanya satu-dua detik per foto atau screenshot khas. Batch lebih besar sekadar butuh waktu yang lebih lama secara proporsional.
Kenapa konversi pertama lebih lambat dari sisanya?
Saat pertama kali kamu memakai alat ini, ia mengunduh model OCR — sekitar 25 MB — ke browsermu lalu menyimpannya di cache. Unduhan sekali itulah bagian yang lambat. Setiap konversi sesudahnya memakai ulang model dari cache dan mulai seketika, bahkan lintas kunjungan dan bahkan offline. Jadi gambar pertama mungkin butuh beberapa detik ekstra; sisanya cepat.
Bisakah membaca tulisan tangan?
Tidak dengan baik, dan kami tak akan berpura-pura sebaliknya. OCR di browser dibuat untuk teks cetak dan ketikan; tulisan sambung dan catatan tangan santai memberi hasil buruk dengan mesin ini. Kami sedang membangun alat tulisan-tangan-ke-teks terpisah yang memakai model lebih berat dan bertujuan khusus persis untuk itu, dan segera hadir. Untuk apa pun yang tercetak — termasuk huruf balok yang rapi — alat ini sudah bekerja baik hari ini.