Çevrimiçi Görsel Metni Tanı — Tarayıcıda OCR
Bir fotoğraftan, taramadan veya ekran görüntüsünden metin çıkarın: İngilizce, Rusça, Çince, Japonca ve daha fazlası. Tarayıcınızda yerel olarak çalışıyor, yükleme yok. Ücretsiz.
JPG, PNG, WebP, GIF, BMP
Dosyanızı buraya sürükleyip bırakın veya seçmek için tıklayın
Görüntülerden metin tanıma hakkında
OCR (Optik Karakter Tanıma), fotoğraflardan, taramalardan ve ekran görüntülerinden basılı ve el yazısı metinleri çıkarır. Bir görsel ekleyin — model metni bulur, satırlar ve kelimelere ayırır ve Word, Google Docs'a yapıştırabileceğiniz veya doğrudan bir çevirmene gönderebileceğiniz bir sonucu döndürür.
Google tarafından eğitilen Tesseract.js tarafından eğitilen açık kaynaklı LSTM sinir ağı tarafından destekleniyor. 16+ dili (İngilizce, Rusça, Çince, Japonca, Korece, Arapça, Ukraynaca, Almanca, Fransızca, İspanyolca, İtalyanca, Lehçece vb.) ve alfabe algılama özelliğiyle 'Otomatik' modu (Kiril / Latince / Han / Japonca / Hangul / Arapça) destekliyor.
Tüm işleme tarayıcınızda yerel olarak çalışır. Görüntü cihazınızdan hiç ayrılmaz, dil paketleri bir kez indirilir ve önbelleğe alınır. Kayıt yok, tanıma sınırı yok. Tanınan metin bir tıklamayla çevirmenimize gönderilebilir.
Faydalı olduğu yerler
Ekran görüntüsünden metin çıkar
PDF'nin ekran görüntüsü, slayt güvertesi, sohbet — metne ihtiyacınız var ama kopyalamak yasak? OCR görüntüyü saniyeler içinde tekrar düzenlenebilir metne dönüştürüyor.
El yazısı veya basılı belgeleri tanıyın
Ders notları, makbuzlar, eski kitaplar — basılı metinle harika çalışıyor ve düzenli el yazısını makul derecede iyi yönetiyor.
Yabancı metni tanıyın ve çevirin
Yabancı bir ülkede menü, Çin talimatları, Almanca tabelalar — tanıma ve 'Çevir' tuşuna tıklayarak metni çevirmenimizde açın.
Telefon fotoğraflarından metin çıkarma
Ders kitabı sayfasını kırttın, program, duyuru? OCR mobilde çalışır, görüntü cihazınızda kalır — özel ve hızlı.
SSS
Hangi diller destekleniyor?
İngilizce, Rusça, Almanca, Fransızca, İspanyolca, İtalyanca, Ukraynaca, Lehçe, Portekizce, Çekçe, Çince (basitleştirilmiş), Japonca, Korece, Arapça. Karışık metinler için 'Rusça + İngilizce' kombinasyonunu kullanın. 'Otomatik' mod, tespit edilen betiklere göre dili seçer.
Görsel sunucuya yükleniyor mu?
Hayır. Tanıma tamamen istemci taraflıdır — Tesseract.js tarayıcınızda WebAssembly olarak çalışır. Görüntü cihazınızdan asla ayrılmaz, sunucu kayıtlarımızda dosya veya metin içermez.
Ne kadar doğru?
Temiz basılı metin için genellikle %95–99 oranında. Doğruluk düşüyor: el yazısı, düşük çözünürlük (<300 DPI), yoğun arka planlar, çarpık geometri. İpucu — dik çekim, iyi ışıkta, kısa kenarda en az 1500 piksel çekin.
El yazısını okuyabilir mi?
Sadece düzenli el yazısı, her dilde değil. Tesseract ağırlıklı olarak basılı fontlar üzerinde eğitilmiştir. Birçok el yazısı için, HTR (El Yazısı Metin Tanıma) modellerine sahip hizmetleri düşünün.
Bir PDF'i tanıyabilir miyim?
Evet — taranmış PDF'ler (PDF'lerin içindeki görseller) için otomatik olarak OCR'ye geçen /pdf/extract-text/ aracımızı kullanın. Bu sayfa tek görselleri işliyor: JPG/PNG/WebP.
Tanınan metni nasıl çevirebilirim?
Tanıma yaptıktan sonra 'Çevir' tuşuna tıklayın — metin çeviricimiz metin önceden doldurulmuş şekilde açılır. Çeviri de yerel, hiçbir şey yüklenmiyor.
Tanıma ne kadar sürer?
Yeni bir dille ilk deneme: 5–15 saniye (model yükü, ~5–15 MB). Aynı dilde sonraki çalışmalar: tipik bir sayfa için 1–5 saniye. Büyük görüntüler (>3000 px) daha yavaştır.