Video OCR Kullanarak Videodan Metin Nasıl Çıkarılır (2026)
On this page
30 dakikalık bir yazılım demosu kaydettiniz. Her menü öğesi, kod parçacığı ve uyarı mesajı ekranda duruyor. Ancak bunları arayamaz, kopyalayamaz veya düzenleyemezsiniz çünkü bir video dosyasının içinde sıkışıp kalmış durumdalar.
Bu rehber, video OCR’ın nasıl çalıştığını, ScreenApp’in Video OCR aracı ile bunu yapmanın en hızlı yolunu ve gerçek fiyatlandırmalarla 8 aracın dürüst bir karşılaştırmasını kapsar. İster dokümantasyon, araştırma veya erişilebilirlik için videodan metin çıkarmanız gereksin, doğru seçeneği burada bulacaksınız.
Hızlı Seçimler
Teknik olmayan kullanıcılar için en iyisi: ScreenApp, ücretsiz plan, Pro yıllık faturalandırmayla ayda $19‘dan başlar. Tek tıklamayla Word/PDF/PPT dışa aktarımı ile video OCR.
En iyi ücretsiz tarayıcı uzantısı: Copyfish, %100 ücretsiz ve açık kaynak. YouTube ve herhangi bir tarayıcı videosunda çalışır.
En iyi ücretsiz açık kaynak kütüphanesi: Tesseract OCR, Ücretsiz. Python kodlama ve manuel kare çıkarma gerektirir.
Geliştiriciler için en iyisi: Google Cloud Vision API, ücretsiz katmandan sonra 1.000 görüntü için 1,50 dolar. Endüstri standardı doğruluk.
AI Sohbet Botları Bunu Neden Yapamaz?
Şunu merak edebilirsiniz: “ChatGPT’den videomdan metin çıkarmasını isteyebilir miyim?” Pek sayılmaz. ChatGPT, Gemini ve diğer AI sohbet botları yüklediğiniz tek tek görüntüleri analiz edebilir, ancak tam bir video dosyasını kare kare işleyemezler. Her kareyi manuel olarak ekran görüntüsü almanız ve tek tek yüklemeniz gerekir ki bu da amacına aykırıdır.
Özel bir video OCR aracı tüm süreci otomatikleştirir: videonuzu karelere ayırma, her görüntüyü daha iyi doğruluk için ön işleme, her karede OCR çalıştırma, yinelenen metni kaldırma ve her şeyi tek bir temiz belgede birleştirme. Bu, tek tek ekran görüntüleri yerine yüzlerce veya binlerce karenin otomatik olarak işlenmesi demektir.
Araç Karşılaştırması
| Araç | Tür | Ücretsiz Katman | Ücretli Fiyat | En İyisi |
|---|---|---|---|---|
| ScreenApp | Çevrimiçi platform | 2 transkripsiyon, 3 yükleme | Pro $19/ay (yıllık), $30/ay (aylık) | Teknik olmayan kullanıcılar, ekran kayıtları |
| Copyfish | Tarayıcı uzantısı | Tamamen ücretsiz | 0 $ (açık kaynak) | YouTube veya herhangi bir tarayıcı videosunda hızlı OCR |
| Selectext | Chrome uzantısı | ~20 ücretsiz kullanım | Kredi tabanlı | YouTube’da duraklatılmış karelerden metin kopyalama |
| Tesseract OCR | Açık kaynak kütüphanesi | Tamamen ücretsiz | 0 $ | Tam işlem hattı kontrolü isteyen geliştiriciler |
| Google Cloud Vision | Geliştirici API’si | 1.000 görüntü/ay | 1.000 görüntü için 1,50 $ | Yüksek doğruluklu toplu işleme |
| Azure Video Indexer | Kurumsal API | 10 saat (web), 40 saat (API) | Dakika başına fiyatlandırma | Büyük ölçekte kurumsal video analizi |
| Twelve Labs | Video AI API | 600 dakika ücretsiz | 0,033 $/dakika | Çok modlu video anlama |
| EdenAI | API toplayıcı | Kaydolurken ücretsiz krediler | Saniye başına faturalandırma | Tek bir API aracılığıyla birden fazla OCR sağlayıcısını test etme |
Sources, checked 2026-09-23: ScreenApp pricing
Video OCR Nasıl Çalışır?
Süreci anlamak, doğru aracı seçmenize yardımcı olur. Video OCR çalıştırdığınızda arka planda neler olduğunu aşağıda bulabilirsiniz:
Adım 1: Kare Çıkarma
Video, tek tek görüntülere (karelere) ayrılır. Tipik bir kurulum, her 1-3 saniyede bir kare yakalar. 30 dakikalık bir video, analiz için 600-1.800 ekran görüntüsü üretebilir.
Adım 2: Görüntü Ön İşleme
Adım 3: Metin Algılama
AI, metnin nerede göründüğünü bulmak için her kareyi tarar ve her kelimenin veya satırın etrafına sınırlayıcı kutular çizer. Bu algılama aşaması, metin bölgelerini okumaya çalışmadan önce tanımlar.
Adım 4: Karakter Tanıma
Yalıtılmış metin bölgeleri bir OCR motorundan geçer. Tesseract gibi açık kaynak araçlar desen eşleştirme kullanırken, Google Cloud Vision ve Amazon Textract gibi bulut API'leri bağlamı anlayan ve karmaşık arka planları işleyen derin öğrenme modelleri kullanır.
Adım 5: Birleştirme
Tüm karelerden gelen metin birleştirilir, kopyalar kaldırılır ve çıktı zaman damgalarıyla tek bir belgeye biçimlendirilir. Bu, binlerce parçalanmış metin parçasını tek bir tutarlı dosyaya dönüştürür.
Geliştiriciler İçin: Özel bir video OCR Python işlem hattı oluşturmak için GitHub’daki pytesseract, PaddleOCR ve EasyOCR’a göz atın. Her biri Python, OpenCV ve OCR’ı kullanıma hazır işlem hatlarında birleştirir. Özellikle PaddleOCR, birçok dil için doğruluk kıyaslamalarında ticari API’leri yakalamıştır.
ScreenApp ile Metin Çıkarın
Beş adımı tek bir tıklamayla nasıl gerçekleştireceğiniz aşağıda açıklanmıştır. ScreenApp’in Videodan Belgeye Dönüştürme İşlem Hattı tüm süreci otomatikleştirir.
- Video Yükle
- OCR Seçeneğini Seç
- AI'ye Sor
- İndir
1. Videonuzu Yükleyin
Video dosyanızı sürükleyip bırakın, bir bağlantı yapıştırın (YouTube, Google Drive vb.) veya Yükle’ye tıklayın. ScreenApp, MP4, MOV, AVI, WebM, YouTube bağlantılarını ve Google Drive dosyalarını destekler.
Başlamak için ScreenApp kontrol panelinize giriş yapın.
2. Video OCR’ı Etkinleştirin
Yükledikten sonra, görsel metin tanımayı etkinleştirmek için Video Analizi (OCR) seçeneğini seçin. Bu, AI’ye ekrandaki tüm metni her kareden okumasını söyler.
Hem konuşulan ses hem de ekrandaki metin içeren videolar için, her şeyi yakalamak üzere OCR’ı ses transkripsiyonu ile birlikte etkinleştirin.
3. AI’yi Bir İstekle Yönlendirin
“Bu videodaki tüm metni çıkar ve madde işaretli bir özet oluştur” gibi bir istek yazın. İhtiyacınız olan formatı, toplantı notlarını, SOP’yi, slayt taslağını, kod dokümantasyonunu vb. açıklayın. İsteğiniz ne kadar spesifik olursa, AI çıktıyı o kadar iyi yapılandırır.
Çıkarma işlemi bittikten sonra, ScreenApp’in AI araçlarını kullanarak ifadeleri düzenleyebilir, içeriği çevirebilir veya raporlar, kontrol listeleri veya ders planları şeklinde yeniden biçimlendirebilirsiniz.
İşlem süresi, video uzunluğuna bağlı olarak genellikle 2-5 dakika sürer.
4. Belgenizi İndirin
Çıkarılan metniniz hazır. İhtiyacınız olan formatta indirin. Videodan metne dönüştürme hakkında daha fazla bilgi edinin:
- Word (.docx): Tamamen düzenlenebilir metin
- PDF: Biçimlendirmesi korunmuş aranabilir metin
- PowerPoint (.pptx): Slaytlar halinde düzenlenmiş metin
- Düz metin (.txt): Kolay kopyalama ve yapıştırma
Dışa aktarılan belgeler, her metin parçasının orijinal videoda ne zaman göründüğünü gösteren zaman damgaları içerir.
Video OCR Araçları İncelendi
Her araca daha yakından bakalım. Fiyatlandırma Şubat 2026’da doğrulandı.
1. ScreenApp
ScreenApp, herhangi bir kodlama gerektirmeden video OCR’ı işleyen tarayıcı tabanlı bir platformdur. Bir video yükleyin, OCR kutusunu işaretleyin ve dakikalar içinde düzenlenebilir bir belge elde edin. Özellikle sessiz ekran kayıtları, yazılım demoları ve sunum yakalamaları için çok iyi çalışır.
Tür: Çevrimiçi platform (tarayıcı tabanlı)
Fiyat: her biri 45 dakikaya kadar 2 transkripsiyon ve 3 ömür boyu yükleme içeren ücretsiz plan, ayrıca ayda 10 AI sohbeti. Pro, $19/ay (yıllık) veya $30/ay (aylık). Maksimum, $34/ay (yıllık) veya $69/ay (aylık) sınırsız AI sohbeti ve daha uzun kayıtlarla.
Artıları: Kodlama gerektirmez, OCR’ı ses transkripsiyonu ile birleştirir, Word/PDF/PPT’ye aktarır, sessiz videolarda çalışır, özel çıktı formatları için AI istem sistemi
Eksileri: İnternet bağlantısı gerektirir, ücretsiz plan 2 transkripsiyonla sınırlıdır, işlem hızı video uzunluğuna bağlıdır
En iyisi: Kod yazmadan veya API’leri yönetmeden video OCR isteyen herkes için
2. Copyfish
Copyfish, tarayıcınızda doğrudan görüntülerden, videolardan ve PDF’lerden metin OCR yapabilen ücretsiz, açık kaynaklı bir tarayıcı uzantısıdır. Chrome, Edge veya Firefox’ta oynayan herhangi bir videoyu duraklatın, bir bölge seçin ve Copyfish metni anında okur. Tam bir video işleme hattı değildir, her seferinde bir kare yakalarsınız, ancak birkaç satır metin almak için en hızlı ücretsiz seçenektir.
Tür: Tarayıcı uzantısı (Chrome, Edge, Firefox)
Fiyat: %100 ücretsiz ve açık kaynak. Ücretli katman yok.
Artıları: Tamamen ücretsiz, herhangi bir tarayıcı videosunda (YouTube, Vimeo vb.) çalışır, 25’ten fazla dili destekler, hesap gerekmez, görüntüler ve PDF’lerde de çalışır
Eksileri: Manuel kare kare yakalama (duraklat, seç, kopyala), toplu video işleme yok, otomatik zaman damgası eşleme yok, doğruluk video çözünürlüğüne bağlıdır
En iyisi: Tam belgeye ihtiyacınız olmadığında videolardan hızlı tek seferlik metin alımları için
3. Selectext
Selectext, 200.000’den fazla kullanıcısı olan bir Chrome uzantısıdır ve bir videoyu duraklatıp doğrudan metin seçmenize olanak tanır, tıpkı bir web sayfasındaki metni vurgulamak gibi. Seçilen metin panonuza kopyalanır. Algılama için AI bilgisayar görüşü kullanır.
Tür: Chrome uzantısı
Fiyat: Freemium. Yaklaşık 20 ücretsiz kullanım, ardından kredi tabanlı fiyatlandırma.
Artıları: Sezgisel seçim arayüzü (metni seçmek için tıklayın ve sürükleyin), hızlı, YouTube ve diğer sitelerde çalışır, 4,3 yıldız derecesi
Eksileri: Ödeme gerektirmeden önce sınırlı ücretsiz kullanım, yalnızca Chrome, manuel tek karelik işlem, düşük çözünürlüklü videolarda (480p altı) zorlanır
En iyisi: Ara sıra bir videodan belirli bir metin parçasını kopyalaması gereken kullanıcılar için
4. Google Cloud Vision API
Google Cloud Vision API, mevcut en doğru OCR hizmetlerinden biridir. Google Cloud Video Intelligence ile birleştirildiğinde, videodaki metni zaman damgaları ve sınırlayıcı kutularla algılayabilir. Kullanmak için kodlama deneyimine ihtiyacınız var.
Tür: Geliştirici API’si (bulut tabanlı)
Fiyat: İlk 1.000 görüntü/ay ücretsiz. Ardından OCR için 1.000 görüntü başına 1,50 $. Yeni hesaplar için 300 $ ücretsiz kredi. Video Intelligence API’sinin dakika başına ayrı fiyatlandırması vardır.
Eksileri: Kodlama ve API entegrasyonu gerektirir, görüntü OCR’ı ve video OCR’ı için ayrı fiyatlandırma, yüksek hacimde maliyetler artar
En iyisi: Büyük ölçekte güvenilir metin çıkarma gerektiren uygulamalar geliştiren geliştiriciler için
5. Tesseract OCR (Python)
Tesseract OCR, en yaygın kullanılan açık kaynak OCR motorudur. Geliştiriciler, video OCR Python projeleri için bunu Python ve OpenCV ile eşleştirir. Kareleri çıkarmak, ön işlemek ve Tesseract’a beslemek için kod yazarsınız.
Tür: Açık kaynak kütüphanesi (yerel olarak çalışır)
Fiyat: Tamamen ücretsiz ve açık kaynak
Artıları: Maliyetsiz, işlem hattı üzerinde tam kontrol, çevrimdışı çalışır, aktif topluluk, 100’den fazla dili destekler, kapsamlı dokümantasyon
Eksileri: Python programlama gerektirir, karmaşık arka planlarda bulut API’lerinden daha düşük doğruluk, her şeyi kendiniz inşa edip sürdürürsünüz, GUI yok
En iyisi: Sıfırdan bir işlem hattı oluşturmaktan çekinmeyen ve tam kontrol isteyen geliştiriciler için
6. Snagit
TechSmith’in Snagit’i, ekran görüntülerinden metin almak için yerleşik bir OCR işlevine sahip bir ekran yakalama aracıdır. Tam video dosyalarında değil, görüntülerde çalışır. Videonuzdan manuel olarak ekran görüntüleri yakalamanız ve her birinde ayrı ayrı OCR çalıştırmanız gerekir.
Tür: Masaüstü uygulaması (Windows/Mac)
Fiyat: Yıllık 39 $ abonelik. Ücretsiz deneme sürümü mevcut.
Artıları: Basit arayüz, hızlı ekran görüntüsü OCR’ı için iyi, TechSmith’in diğer araçlarıyla entegre olur, çevrimdışı çalışır
Eksileri: Video için tasarlanmamış, yalnızca görüntüler, manuel kare yakalama gerektirir, toplu işleme yok, zaman damgası eşleme yok
En iyisi: Yalnızca birkaç ekran görüntüsünden metin isteyen, tam video işleme istemeyen kullanıcılar için
7. Azure Video Indexer
Azure Video Indexer, konuşma transkripsiyonunu, yüz algılamayı ve OCR’ı tek bir kurumsal platformda birleştirir. Tüm video dosyalarını işler ve aynı anda birden fazla meta veri türünü çıkarır.
Tür: Kurumsal bulut API’si
Fiyat: Ücretsiz deneme: 10 saat (web) veya 40 saat (API). Ücretli katmanlar: Temel, Standart ve Gelişmiş, dakika başına fiyatlandırma ile. Azure aboneliği gerektirir.
Artıları: Tam video analizi (OCR + konuşma + yüzler + nesneler), kurumsal güvenilirlik, Microsoft ekosistemiyle entegre olur, video dosyalarını doğrudan işler
Eksileri: Azure hesabı ve teknik kurulum gerektirir, karmaşık fiyatlandırma, basit metin çıkarma için aşırıya kaçar, öğrenme eğrisi diktir
En iyisi: Diğer video zekası özelliklerinin yanı sıra OCR’a ihtiyaç duyan binlerce videoyu işleyen büyük kuruluşlar için
8. Twelve Labs
Twelve Labs, geleneksel OCR’ın ötesine geçen çok modlu bir video AI platformudur. Video karelerini bağlam içinde analiz eder, metnin görsel olarak ne olup bittiğiyle nasıl ilişkili olduğunu anlar, tıpkı GPT-4o’nun görüntüleri işlemesi gibi, ancak tüm video zaman çizelgesine uygulanır.
Tür: Video AI API’si
Fiyat: 600 dakika video ücretsiz. Geliştirici planı, indeksleme için dakika başına 0,033 $‘dan başlar.
Artıları: Kareler arasında bağlam duyarlı analiz, çok modlu anlama (metin + görsel + ses), cömert ücretsiz katman, modern API tasarımı
Eksileri: Daha küçük topluluğa sahip yeni platform, API entegrasyonu gerektirir, uzun videolarla maliyetler artar
En iyisi: Daha büyük bir sistemin parçası olarak OCR’a ihtiyaç duyan video arama veya analiz özellikleri geliştiren geliştiriciler için
Video OCR’a Kimler İhtiyaç Duyar?
Video OCR, farklı endüstrilerde ve rollerde pratik sorunları çözer.
İK ve Eğitim Ekipleri
Yazılım eğitimlerinin sessiz ekran kayıtlarını yazılı SOP'lere dönüştürün. Ekranınızı kaydedin, Video OCR çalıştırın ve manuel dokümantasyon olmadan eksiksiz bir adım adım rehber elde edin.
Öğrenciler ve Eğitimciler
Bir dersin sunum slaytlarındaki tüm metni elle kopyalamadan çekin. Her slaytın içeriğini dakikalar içinde notlarınıza almak için çevrimiçi video OCR kullanın.
Geliştiriciler ve QA Ekipleri
Hata raporu videolarından hata mesajlarını, günlük çıktılarını ve UI metnini çıkarın. Manuel olarak videoyu taramak yerine aranabilir metin elde etmek için bir ekran kaydında OCR çalıştırın.
ScreenApp Video OCR’ı Deneyin
Videoları duraklatmaktan ve ekrandaki metni manuel olarak yeniden yazmaktan sıkıldıysanız, ScreenApp’i deneyin. Ücretsiz plan, kendi dosyalarınızdan birinde video OCR’ı test etmenize olanak tanır. Bir video yükleyin, OCR seçeneğini etkinleştirin ve birkaç dakika içinde biçimlendirilmiş bir belge elde edin. Videonuzda hem konuşulan hem de görsel içerik varsa OCR’ı ses transkripsiyonu ile birleştirebilir veya eksiksiz bir yazılı kayıt için videodan belgeye dönüştürme kullanabilirsiniz.
İlgili Rehberler
- ScreenApp Video OCR Özelliği, Video OCR yeteneğine tam genel bakış
- Videodan Belgeye Dönüştürme, Herhangi bir videoyu Word, PDF veya PPT’ye dönüştürün
- Videodan Metne Dönüştürücü, Video dosyalarından veya URL’lerden metin çıkarın
- Videodan PowerPoint’e, Video içeriğini slayt sunumlarına dönüştürün
- AI ile Videodan SOP Oluşturma, Ekran kayıtlarını standart işletim prosedürlerine dönüştürün
- En İyi AI Altyazı Oluşturucuları, Altyazı oluşturma ve çıkarma araçları
FAQ
Telefonumdan videodan metin çıkarabilir miyim?
Evet, kısmen. iOS'ta Canlı Metin ve Android'de Google Lens bulunur. Her ikisi de kameranızdan veya fotoğraflarınızdan metin okuyabilir, ancak hiçbiri tüm video dosyalarını otomatik olarak işlemez. Tek görüntülerde veya canlı kamera akışlarında çalışırlar. Tam video OCR (bir video dosyasının her karesi) için, tüm dosyayı işleyen ve metni birleştiren ScreenApp gibi bir araca ihtiyacınız vardır.
Google OCR ücretsiz mi?
Google Lens, fotoğraflarda ve canlı kamerada kişisel kullanım için ücretsizdir. Google Cloud Vision API, geliştiricilere ayda 1.000 ücretsiz görüntü analizi sunar, ardından 1.000 görüntü başına 1,50 $ ücret alır. Yeni hesaplar 300 $ ücretsiz kredi alır. Özellikle video OCR için, Video Intelligence API'sinin dakika başına ayrı fiyatlandırması vardır.
ChatGPT videodan metin çıkarabilir mi?
Otomatik olarak değil. ChatGPT (GPT-4o ile) tek tek görüntüleri analiz edebilir ve onlardan metin okuyabilir, ancak tam bir videoyu yükleyip her kareyi işlemesini sağlayamazsınız. Her kareyi manuel olarak ekran görüntüsü almanız, görüntüleri tek tek yüklemeniz ve ardından metni kendiniz bir araya getirmeniz gerekir. Özel bir video OCR aracı, tüm kareleri otomatik olarak işler ve tek bir birleştirilmiş belge üretir, kısa bir videoda bile saatlerce süren manuel çalışmadan tasarruf sağlar.
Transkripsiyon ve video OCR arasındaki fark nedir?
Ses transkripsiyonu, konuşulan kelimeleri (ses parçasını) metne dönüştürür. Video OCR, görünür metni (ekrandaki pikselleri) okur ve bunu metne dönüştürür. Biri konuşuyorsa, transkripsiyon kullanın. Ekranda metin, menüler, kod, slaytlar, altyazılar görüntüleniyorsa, OCR kullanın. ScreenApp, her şeyi yakalamak için aynı videoda her ikisini de aynı anda çalıştırabilir.
Video OCR, sabit kodlanmış altyazıları çıkarabilir mi?
Evet. Video OCR, gömülü (sabit kodlanmış) altyazıları, ekrandaki diğer metinleri okuduğu gibi okur. AI, her kareyi işler ve altyazı metnini otomatik olarak alır. Bu, altyazıları çevirmeniz, diyalog aramanız veya altyazıların ayrı bir .srt dosyasında olmadığı videolardan içeriği yeniden kullanmanız gerektiğinde kullanışlıdır. Altyazıya özel çıkarma için, AI altyazı oluşturucuları hakkındaki rehberimize de göz atın.
Ücretsiz bir video OCR aracı var mı?
Birkaç tane var. Copyfish, duraklatılmış video karelerinde OCR yapan tamamen ücretsiz, açık kaynaklı bir tarayıcı uzantısıdır. Tesseract OCR ücretsizdir ancak Python kodlama gerektirir. ScreenApp'in bir kayıt ve 2 transkripsiyonu kapsayan ücretsiz bir planı vardır.
Video OCR ile hangi video formatları çalışır?
Çoğu video OCR aracı yaygın formatları kabul eder: MP4, MOV, AVI, WebM ve MKV. ScreenApp ayrıca YouTube bağlantılarını ve Google Drive dosyalarını doğrudan kabul eder, videoyu önce indirmenize gerek yoktur. Tesseract gibi geliştirici araçları için format desteği, kare çıkarma kütüphanenize bağlıdır (OpenCV neredeyse her formatı destekler).