Lompat ke konten

Computer Vision2023

Deteksi Teks Real-Time pada Video dengan EasyOCR dan OpenCV

Pipeline OCR ringan yang membaca teks per frame, menggambarkannya kembali ke video, dan menyimpan hasil beranotasi ke berkas baru. Proyek kecil, jawaban langsung untuk kebutuhan analitik video yang umum.

Teknologi
EasyOCR · OpenCV · Python · NumPy

Konteks

Pekerjaan analitik video kerap membutuhkan pembacaan teks dari frame: pelat nomor, label panel, atau papan informasi. Pertanyaannya, seberapa jauh tumpukan OCR ringan bisa dipakai tanpa model deteksi berat di belakangnya.

Masalah

Menjalankan OCR pada video berbeda dengan menjalankannya pada gambar. Setiap frame adalah inferensi baru, hasilnya harus digambarkan kembali ke posisi yang tepat pada frame, dan keseluruhan proses harus mengikuti laju pemutaran sambil tetap menghasilkan berkas yang bisa ditinjau ulang.

Pendekatan

Pipeline membaca video frame demi frame dengan OpenCV, meneruskan tiap frame ke EasyOCR, lalu memetakan region teks yang terdeteksi kembali menjadi bounding box pada frame asli. Frame beranotasi ditulis ke berkas video baru, sehingga hasilnya bisa ditinjau, bukan sekadar dicetak ke konsol.

Hasil

  • Visualisasi bounding box real-time untuk teks yang terdeteksi di setiap frame

  • Pemrosesan frame demi frame dengan keluaran beranotasi tersimpan sebagai berkas video baru

  • Basis yang bisa dipakai ulang untuk kebutuhan analitik video yang memerlukan ekstraksi teks

Catatan

Dibuat sebagai latihan terfokus soal integrasi OCR pada video, bukan sebagai sistem produksi. Sampai sekarang ini tetap potongan kode pertama yang saya ambil ketika sebuah proyek baru perlu membuktikan bahwa teks bisa dibaca dengan andal dari sudut kamera tertentu.

Semua proyek