· 13 min read

Video OCR Kullanarak Videodan Metin Nasıl Çıkarılır (2026)

Video OCR Kullanarak Videodan Metin Nasıl Çıkarılır (2026)
On this page

30 dakikalık bir yazılım demosu kaydettiniz. Her menü öğesi, kod parçacığı ve uyarı mesajı ekranda duruyor. Ancak bunları arayamaz, kopyalayamaz veya düzenleyemezsiniz çünkü bir video dosyasının içinde sıkışıp kalmış durumdalar.

Bu rehber, video OCR’ın nasıl çalıştığını, ScreenApp’in Video OCR aracı ile bunu yapmanın en hızlı yolunu ve gerçek fiyatlandırmalarla 8 aracın dürüst bir karşılaştırmasını kapsar. İster dokümantasyon, araştırma veya erişilebilirlik için videodan metin çıkarmanız gereksin, doğru seçeneği burada bulacaksınız.

Hızlı Seçimler

Teknik olmayan kullanıcılar için en iyisi: ScreenApp, ücretsiz plan, Pro yıllık faturalandırmayla ayda $19‘dan başlar. Tek tıklamayla Word/PDF/PPT dışa aktarımı ile video OCR.

En iyi ücretsiz tarayıcı uzantısı: Copyfish, %100 ücretsiz ve açık kaynak. YouTube ve herhangi bir tarayıcı videosunda çalışır.

En iyi ücretsiz açık kaynak kütüphanesi: Tesseract OCR, Ücretsiz. Python kodlama ve manuel kare çıkarma gerektirir.

Geliştiriciler için en iyisi: Google Cloud Vision API, ücretsiz katmandan sonra 1.000 görüntü için 1,50 dolar. Endüstri standardı doğruluk.

AI Sohbet Botları Bunu Neden Yapamaz?

Şunu merak edebilirsiniz: “ChatGPT’den videomdan metin çıkarmasını isteyebilir miyim?” Pek sayılmaz. ChatGPT, Gemini ve diğer AI sohbet botları yüklediğiniz tek tek görüntüleri analiz edebilir, ancak tam bir video dosyasını kare kare işleyemezler. Her kareyi manuel olarak ekran görüntüsü almanız ve tek tek yüklemeniz gerekir ki bu da amacına aykırıdır.

Özel bir video OCR aracı tüm süreci otomatikleştirir: videonuzu karelere ayırma, her görüntüyü daha iyi doğruluk için ön işleme, her karede OCR çalıştırma, yinelenen metni kaldırma ve her şeyi tek bir temiz belgede birleştirme. Bu, tek tek ekran görüntüleri yerine yüzlerce veya binlerce karenin otomatik olarak işlenmesi demektir.

Araç Karşılaştırması

AraçTürÜcretsiz KatmanÜcretli FiyatEn İyisi
ScreenAppÇevrimiçi platform2 transkripsiyon, 3 yüklemePro $19/ay (yıllık), $30/ay (aylık)Teknik olmayan kullanıcılar, ekran kayıtları
CopyfishTarayıcı uzantısıTamamen ücretsiz0 $ (açık kaynak)YouTube veya herhangi bir tarayıcı videosunda hızlı OCR
SelectextChrome uzantısı~20 ücretsiz kullanımKredi tabanlıYouTube’da duraklatılmış karelerden metin kopyalama
Tesseract OCRAçık kaynak kütüphanesiTamamen ücretsiz0 $Tam işlem hattı kontrolü isteyen geliştiriciler
Google Cloud VisionGeliştirici API’si1.000 görüntü/ay1.000 görüntü için 1,50 $Yüksek doğruluklu toplu işleme
Azure Video IndexerKurumsal API10 saat (web), 40 saat (API)Dakika başına fiyatlandırmaBüyük ölçekte kurumsal video analizi
Twelve LabsVideo AI API600 dakika ücretsiz0,033 $/dakikaÇok modlu video anlama
EdenAIAPI toplayıcıKaydolurken ücretsiz kredilerSaniye başına faturalandırmaTek bir API aracılığıyla birden fazla OCR sağlayıcısını test etme

Sources, checked 2026-09-23: ScreenApp pricing

Video OCR Nasıl Çalışır?

Süreci anlamak, doğru aracı seçmenize yardımcı olur. Video OCR çalıştırdığınızda arka planda neler olduğunu aşağıda bulabilirsiniz:

Adım 1: Kare Çıkarma

Video, tek tek görüntülere (karelere) ayrılır. Tipik bir kurulum, her 1-3 saniyede bir kare yakalar. 30 dakikalık bir video, analiz için 600-1.800 ekran görüntüsü üretebilir.

Adım 2: Görüntü Ön İşleme

Adım 3: Metin Algılama

AI, metnin nerede göründüğünü bulmak için her kareyi tarar ve her kelimenin veya satırın etrafına sınırlayıcı kutular çizer. Bu algılama aşaması, metin bölgelerini okumaya çalışmadan önce tanımlar.

Adım 4: Karakter Tanıma

Yalıtılmış metin bölgeleri bir OCR motorundan geçer. Tesseract gibi açık kaynak araçlar desen eşleştirme kullanırken, Google Cloud Vision ve Amazon Textract gibi bulut API'leri bağlamı anlayan ve karmaşık arka planları işleyen derin öğrenme modelleri kullanır.

Adım 5: Birleştirme

Tüm karelerden gelen metin birleştirilir, kopyalar kaldırılır ve çıktı zaman damgalarıyla tek bir belgeye biçimlendirilir. Bu, binlerce parçalanmış metin parçasını tek bir tutarlı dosyaya dönüştürür.

Geliştiriciler İçin: Özel bir video OCR Python işlem hattı oluşturmak için GitHub’daki pytesseract, PaddleOCR ve EasyOCR’a göz atın. Her biri Python, OpenCV ve OCR’ı kullanıma hazır işlem hatlarında birleştirir. Özellikle PaddleOCR, birçok dil için doğruluk kıyaslamalarında ticari API’leri yakalamıştır.

ScreenApp ile Metin Çıkarın

Beş adımı tek bir tıklamayla nasıl gerçekleştireceğiniz aşağıda açıklanmıştır. ScreenApp’in Videodan Belgeye Dönüştürme İşlem Hattı tüm süreci otomatikleştirir.

  • Video Yükle
  • OCR Seçeneğini Seç
  • AI'ye Sor
  • İndir

1. Videonuzu Yükleyin

Videonuzu Yükleyin

Video dosyanızı sürükleyip bırakın, bir bağlantı yapıştırın (YouTube, Google Drive vb.) veya Yükle’ye tıklayın. ScreenApp, MP4, MOV, AVI, WebM, YouTube bağlantılarını ve Google Drive dosyalarını destekler.

Başlamak için ScreenApp kontrol panelinize giriş yapın.

2. Video OCR’ı Etkinleştirin

ScreenApp'te Video OCR seçeneğini etkinleştirin

Yükledikten sonra, görsel metin tanımayı etkinleştirmek için Video Analizi (OCR) seçeneğini seçin. Bu, AI’ye ekrandaki tüm metni her kareden okumasını söyler.

Hem konuşulan ses hem de ekrandaki metin içeren videolar için, her şeyi yakalamak üzere OCR’ı ses transkripsiyonu ile birlikte etkinleştirin.

İpucu: Sessiz ekran kayıtları için, transkribe edilecek ses olmadığı için OCR çok önemlidir. AI, belgenizi tamamen ekrandaki görsel metinden oluşturur.

3. AI’yi Bir İstekle Yönlendirin

Video OCR için AI isteği

“Bu videodaki tüm metni çıkar ve madde işaretli bir özet oluştur” gibi bir istek yazın. İhtiyacınız olan formatı, toplantı notlarını, SOP’yi, slayt taslağını, kod dokümantasyonunu vb. açıklayın. İsteğiniz ne kadar spesifik olursa, AI çıktıyı o kadar iyi yapılandırır.

Çıkarma işlemi bittikten sonra, ScreenApp’in AI araçlarını kullanarak ifadeleri düzenleyebilir, içeriği çevirebilir veya raporlar, kontrol listeleri veya ders planları şeklinde yeniden biçimlendirebilirsiniz.

İşlem süresi, video uzunluğuna bağlı olarak genellikle 2-5 dakika sürer.

4. Belgenizi İndirin

Belgenizi İndirin

Çıkarılan metniniz hazır. İhtiyacınız olan formatta indirin. Videodan metne dönüştürme hakkında daha fazla bilgi edinin:

  • Word (.docx): Tamamen düzenlenebilir metin
  • PDF: Biçimlendirmesi korunmuş aranabilir metin
  • PowerPoint (.pptx): Slaytlar halinde düzenlenmiş metin
  • Düz metin (.txt): Kolay kopyalama ve yapıştırma

Dışa aktarılan belgeler, her metin parçasının orijinal videoda ne zaman göründüğünü gösteren zaman damgaları içerir.

Video OCR Araçları İncelendi

Her araca daha yakından bakalım. Fiyatlandırma Şubat 2026’da doğrulandı.

1. ScreenApp

ScreenApp, herhangi bir kodlama gerektirmeden video OCR’ı işleyen tarayıcı tabanlı bir platformdur. Bir video yükleyin, OCR kutusunu işaretleyin ve dakikalar içinde düzenlenebilir bir belge elde edin. Özellikle sessiz ekran kayıtları, yazılım demoları ve sunum yakalamaları için çok iyi çalışır.

Tür: Çevrimiçi platform (tarayıcı tabanlı)

Fiyat: her biri 45 dakikaya kadar 2 transkripsiyon ve 3 ömür boyu yükleme içeren ücretsiz plan, ayrıca ayda 10 AI sohbeti. Pro, $19/ay (yıllık) veya $30/ay (aylık). Maksimum, $34/ay (yıllık) veya $69/ay (aylık) sınırsız AI sohbeti ve daha uzun kayıtlarla.

Artıları: Kodlama gerektirmez, OCR’ı ses transkripsiyonu ile birleştirir, Word/PDF/PPT’ye aktarır, sessiz videolarda çalışır, özel çıktı formatları için AI istem sistemi

Eksileri: İnternet bağlantısı gerektirir, ücretsiz plan 2 transkripsiyonla sınırlıdır, işlem hızı video uzunluğuna bağlıdır

En iyisi: Kod yazmadan veya API’leri yönetmeden video OCR isteyen herkes için

2. Copyfish

Copyfish, tarayıcınızda doğrudan görüntülerden, videolardan ve PDF’lerden metin OCR yapabilen ücretsiz, açık kaynaklı bir tarayıcı uzantısıdır. Chrome, Edge veya Firefox’ta oynayan herhangi bir videoyu duraklatın, bir bölge seçin ve Copyfish metni anında okur. Tam bir video işleme hattı değildir, her seferinde bir kare yakalarsınız, ancak birkaç satır metin almak için en hızlı ücretsiz seçenektir.

Tür: Tarayıcı uzantısı (Chrome, Edge, Firefox)

Fiyat: %100 ücretsiz ve açık kaynak. Ücretli katman yok.

Artıları: Tamamen ücretsiz, herhangi bir tarayıcı videosunda (YouTube, Vimeo vb.) çalışır, 25’ten fazla dili destekler, hesap gerekmez, görüntüler ve PDF’lerde de çalışır

Eksileri: Manuel kare kare yakalama (duraklat, seç, kopyala), toplu video işleme yok, otomatik zaman damgası eşleme yok, doğruluk video çözünürlüğüne bağlıdır

En iyisi: Tam belgeye ihtiyacınız olmadığında videolardan hızlı tek seferlik metin alımları için

3. Selectext

Selectext, 200.000’den fazla kullanıcısı olan bir Chrome uzantısıdır ve bir videoyu duraklatıp doğrudan metin seçmenize olanak tanır, tıpkı bir web sayfasındaki metni vurgulamak gibi. Seçilen metin panonuza kopyalanır. Algılama için AI bilgisayar görüşü kullanır.

Tür: Chrome uzantısı

Fiyat: Freemium. Yaklaşık 20 ücretsiz kullanım, ardından kredi tabanlı fiyatlandırma.

Artıları: Sezgisel seçim arayüzü (metni seçmek için tıklayın ve sürükleyin), hızlı, YouTube ve diğer sitelerde çalışır, 4,3 yıldız derecesi

Eksileri: Ödeme gerektirmeden önce sınırlı ücretsiz kullanım, yalnızca Chrome, manuel tek karelik işlem, düşük çözünürlüklü videolarda (480p altı) zorlanır

En iyisi: Ara sıra bir videodan belirli bir metin parçasını kopyalaması gereken kullanıcılar için

4. Google Cloud Vision API

Google Cloud Vision API, mevcut en doğru OCR hizmetlerinden biridir. Google Cloud Video Intelligence ile birleştirildiğinde, videodaki metni zaman damgaları ve sınırlayıcı kutularla algılayabilir. Kullanmak için kodlama deneyimine ihtiyacınız var.

Tür: Geliştirici API’si (bulut tabanlı)

Fiyat: İlk 1.000 görüntü/ay ücretsiz. Ardından OCR için 1.000 görüntü başına 1,50 $. Yeni hesaplar için 300 $ ücretsiz kredi. Video Intelligence API’sinin dakika başına ayrı fiyatlandırması vardır.

Eksileri: Kodlama ve API entegrasyonu gerektirir, görüntü OCR’ı ve video OCR’ı için ayrı fiyatlandırma, yüksek hacimde maliyetler artar

En iyisi: Büyük ölçekte güvenilir metin çıkarma gerektiren uygulamalar geliştiren geliştiriciler için

5. Tesseract OCR (Python)

Tesseract OCR, en yaygın kullanılan açık kaynak OCR motorudur. Geliştiriciler, video OCR Python projeleri için bunu Python ve OpenCV ile eşleştirir. Kareleri çıkarmak, ön işlemek ve Tesseract’a beslemek için kod yazarsınız.

Tür: Açık kaynak kütüphanesi (yerel olarak çalışır)

Fiyat: Tamamen ücretsiz ve açık kaynak

Artıları: Maliyetsiz, işlem hattı üzerinde tam kontrol, çevrimdışı çalışır, aktif topluluk, 100’den fazla dili destekler, kapsamlı dokümantasyon

Eksileri: Python programlama gerektirir, karmaşık arka planlarda bulut API’lerinden daha düşük doğruluk, her şeyi kendiniz inşa edip sürdürürsünüz, GUI yok

En iyisi: Sıfırdan bir işlem hattı oluşturmaktan çekinmeyen ve tam kontrol isteyen geliştiriciler için

6. Snagit

TechSmith’in Snagit’i, ekran görüntülerinden metin almak için yerleşik bir OCR işlevine sahip bir ekran yakalama aracıdır. Tam video dosyalarında değil, görüntülerde çalışır. Videonuzdan manuel olarak ekran görüntüleri yakalamanız ve her birinde ayrı ayrı OCR çalıştırmanız gerekir.

Tür: Masaüstü uygulaması (Windows/Mac)

Fiyat: Yıllık 39 $ abonelik. Ücretsiz deneme sürümü mevcut.

Artıları: Basit arayüz, hızlı ekran görüntüsü OCR’ı için iyi, TechSmith’in diğer araçlarıyla entegre olur, çevrimdışı çalışır

Eksileri: Video için tasarlanmamış, yalnızca görüntüler, manuel kare yakalama gerektirir, toplu işleme yok, zaman damgası eşleme yok

En iyisi: Yalnızca birkaç ekran görüntüsünden metin isteyen, tam video işleme istemeyen kullanıcılar için

7. Azure Video Indexer

Azure Video Indexer, konuşma transkripsiyonunu, yüz algılamayı ve OCR’ı tek bir kurumsal platformda birleştirir. Tüm video dosyalarını işler ve aynı anda birden fazla meta veri türünü çıkarır.

Tür: Kurumsal bulut API’si

Fiyat: Ücretsiz deneme: 10 saat (web) veya 40 saat (API). Ücretli katmanlar: Temel, Standart ve Gelişmiş, dakika başına fiyatlandırma ile. Azure aboneliği gerektirir.

Artıları: Tam video analizi (OCR + konuşma + yüzler + nesneler), kurumsal güvenilirlik, Microsoft ekosistemiyle entegre olur, video dosyalarını doğrudan işler

Eksileri: Azure hesabı ve teknik kurulum gerektirir, karmaşık fiyatlandırma, basit metin çıkarma için aşırıya kaçar, öğrenme eğrisi diktir

En iyisi: Diğer video zekası özelliklerinin yanı sıra OCR’a ihtiyaç duyan binlerce videoyu işleyen büyük kuruluşlar için

8. Twelve Labs

Twelve Labs, geleneksel OCR’ın ötesine geçen çok modlu bir video AI platformudur. Video karelerini bağlam içinde analiz eder, metnin görsel olarak ne olup bittiğiyle nasıl ilişkili olduğunu anlar, tıpkı GPT-4o’nun görüntüleri işlemesi gibi, ancak tüm video zaman çizelgesine uygulanır.

Tür: Video AI API’si

Fiyat: 600 dakika video ücretsiz. Geliştirici planı, indeksleme için dakika başına 0,033 $‘dan başlar.

Artıları: Kareler arasında bağlam duyarlı analiz, çok modlu anlama (metin + görsel + ses), cömert ücretsiz katman, modern API tasarımı

Eksileri: Daha küçük topluluğa sahip yeni platform, API entegrasyonu gerektirir, uzun videolarla maliyetler artar

En iyisi: Daha büyük bir sistemin parçası olarak OCR’a ihtiyaç duyan video arama veya analiz özellikleri geliştiren geliştiriciler için

Video OCR’a Kimler İhtiyaç Duyar?

Video OCR, farklı endüstrilerde ve rollerde pratik sorunları çözer.

İK ve Eğitim Ekipleri

Yazılım eğitimlerinin sessiz ekran kayıtlarını yazılı SOP'lere dönüştürün. Ekranınızı kaydedin, Video OCR çalıştırın ve manuel dokümantasyon olmadan eksiksiz bir adım adım rehber elde edin.

Öğrenciler ve Eğitimciler

Bir dersin sunum slaytlarındaki tüm metni elle kopyalamadan çekin. Her slaytın içeriğini dakikalar içinde notlarınıza almak için çevrimiçi video OCR kullanın.

Geliştiriciler ve QA Ekipleri

Hata raporu videolarından hata mesajlarını, günlük çıktılarını ve UI metnini çıkarın. Manuel olarak videoyu taramak yerine aranabilir metin elde etmek için bir ekran kaydında OCR çalıştırın.

ScreenApp Video OCR’ı Deneyin

Videoları duraklatmaktan ve ekrandaki metni manuel olarak yeniden yazmaktan sıkıldıysanız, ScreenApp’i deneyin. Ücretsiz plan, kendi dosyalarınızdan birinde video OCR’ı test etmenize olanak tanır. Bir video yükleyin, OCR seçeneğini etkinleştirin ve birkaç dakika içinde biçimlendirilmiş bir belge elde edin. Videonuzda hem konuşulan hem de görsel içerik varsa OCR’ı ses transkripsiyonu ile birleştirebilir veya eksiksiz bir yazılı kayıt için videodan belgeye dönüştürme kullanabilirsiniz.

Video OCR’ı Ücretsiz Deneyin

İlgili Rehberler

FAQ

Telefonumdan videodan metin çıkarabilir miyim?

Evet, kısmen. iOS'ta Canlı Metin ve Android'de Google Lens bulunur. Her ikisi de kameranızdan veya fotoğraflarınızdan metin okuyabilir, ancak hiçbiri tüm video dosyalarını otomatik olarak işlemez. Tek görüntülerde veya canlı kamera akışlarında çalışırlar. Tam video OCR (bir video dosyasının her karesi) için, tüm dosyayı işleyen ve metni birleştiren ScreenApp gibi bir araca ihtiyacınız vardır.

Google OCR ücretsiz mi?

Google Lens, fotoğraflarda ve canlı kamerada kişisel kullanım için ücretsizdir. Google Cloud Vision API, geliştiricilere ayda 1.000 ücretsiz görüntü analizi sunar, ardından 1.000 görüntü başına 1,50 $ ücret alır. Yeni hesaplar 300 $ ücretsiz kredi alır. Özellikle video OCR için, Video Intelligence API'sinin dakika başına ayrı fiyatlandırması vardır.

ChatGPT videodan metin çıkarabilir mi?

Otomatik olarak değil. ChatGPT (GPT-4o ile) tek tek görüntüleri analiz edebilir ve onlardan metin okuyabilir, ancak tam bir videoyu yükleyip her kareyi işlemesini sağlayamazsınız. Her kareyi manuel olarak ekran görüntüsü almanız, görüntüleri tek tek yüklemeniz ve ardından metni kendiniz bir araya getirmeniz gerekir. Özel bir video OCR aracı, tüm kareleri otomatik olarak işler ve tek bir birleştirilmiş belge üretir, kısa bir videoda bile saatlerce süren manuel çalışmadan tasarruf sağlar.

Transkripsiyon ve video OCR arasındaki fark nedir?

Ses transkripsiyonu, konuşulan kelimeleri (ses parçasını) metne dönüştürür. Video OCR, görünür metni (ekrandaki pikselleri) okur ve bunu metne dönüştürür. Biri konuşuyorsa, transkripsiyon kullanın. Ekranda metin, menüler, kod, slaytlar, altyazılar görüntüleniyorsa, OCR kullanın. ScreenApp, her şeyi yakalamak için aynı videoda her ikisini de aynı anda çalıştırabilir.

Video OCR, sabit kodlanmış altyazıları çıkarabilir mi?

Evet. Video OCR, gömülü (sabit kodlanmış) altyazıları, ekrandaki diğer metinleri okuduğu gibi okur. AI, her kareyi işler ve altyazı metnini otomatik olarak alır. Bu, altyazıları çevirmeniz, diyalog aramanız veya altyazıların ayrı bir .srt dosyasında olmadığı videolardan içeriği yeniden kullanmanız gerektiğinde kullanışlıdır. Altyazıya özel çıkarma için, AI altyazı oluşturucuları hakkındaki rehberimize de göz atın.

Ücretsiz bir video OCR aracı var mı?

Birkaç tane var. Copyfish, duraklatılmış video karelerinde OCR yapan tamamen ücretsiz, açık kaynaklı bir tarayıcı uzantısıdır. Tesseract OCR ücretsizdir ancak Python kodlama gerektirir. ScreenApp'in bir kayıt ve 2 transkripsiyonu kapsayan ücretsiz bir planı vardır.

Video OCR ile hangi video formatları çalışır?

Çoğu video OCR aracı yaygın formatları kabul eder: MP4, MOV, AVI, WebM ve MKV. ScreenApp ayrıca YouTube bağlantılarını ve Google Drive dosyalarını doğrudan kabul eder, videoyu önce indirmenize gerek yoktur. Tesseract gibi geliştirici araçları için format desteği, kare çıkarma kütüphanenize bağlıdır (OpenCV neredeyse her formatı destekler).

Daha Fazla İçgörü Keşfedin

Üretkenlik ipuçları, teknoloji içgörüleri ve yazılım çözümleri için blogumuzu keşfedin.

Try ScreenApp Free

Start recording in 60 seconds