Computer Vision2023
Deteksi Teks Real-Time pada Video dengan EasyOCR dan OpenCV
Pipeline OCR ringan yang membaca teks per frame, menggambarkannya kembali ke video, dan menyimpan hasil beranotasi ke berkas baru. Proyek kecil, jawaban langsung untuk kebutuhan analitik video yang umum.
- Teknologi
- EasyOCR · OpenCV · Python · NumPy
Konteks
Pekerjaan analitik video kerap membutuhkan pembacaan teks dari frame: pelat nomor, label panel, atau papan informasi. Pertanyaannya, seberapa jauh tumpukan OCR ringan bisa dipakai tanpa model deteksi berat di belakangnya.
Masalah
Menjalankan OCR pada video berbeda dengan menjalankannya pada gambar. Setiap frame adalah inferensi baru, hasilnya harus digambarkan kembali ke posisi yang tepat pada frame, dan keseluruhan proses harus mengikuti laju pemutaran sambil tetap menghasilkan berkas yang bisa ditinjau ulang.
Pendekatan
Pipeline membaca video frame demi frame dengan OpenCV, meneruskan tiap frame ke EasyOCR, lalu memetakan region teks yang terdeteksi kembali menjadi bounding box pada frame asli. Frame beranotasi ditulis ke berkas video baru, sehingga hasilnya bisa ditinjau, bukan sekadar dicetak ke konsol.
Hasil
Visualisasi bounding box real-time untuk teks yang terdeteksi di setiap frame
Pemrosesan frame demi frame dengan keluaran beranotasi tersimpan sebagai berkas video baru
Basis yang bisa dipakai ulang untuk kebutuhan analitik video yang memerlukan ekstraksi teks
Catatan
Dibuat sebagai latihan terfokus soal integrasi OCR pada video, bukan sebagai sistem produksi. Sampai sekarang ini tetap potongan kode pertama yang saya ambil ketika sebuah proyek baru perlu membuktikan bahwa teks bisa dibaca dengan andal dari sudut kamera tertentu.

