- Prime Video meluncurkan teknologi Lip-sync berbasis AI untuk menyelaraskan gerakan mulut aktor dengan audio sulih suara.
- Teknologi tersebut pertama kali diterapkan secara global pada serial Maxton Hall musim pertama dan kedua dalam bahasa Inggris.
- Penerapan inovasi ini bertujuan memberikan pengalaman menonton yang lebih imersif tanpa menggantikan peran pengisi suara manusia.
Suara.com - Salah satu hal yang sering mengganggu saat menonton film atau serial dengan sulih suara adalah gerakan mulut aktor yang tidak lagi pas dengan dialog. Suara sudah selesai, tetapi mulut masih bergerak, atau sebaliknya.
Masalah tersebut kini coba diatasi dengan teknologi AI dan visual effects (VFX). Teknologi ini memungkinkan gerakan mulut aktor disesuaikan dengan audio dubbing yang direkam oleh pengisi suara manusia.
Pendekatan tersebut diterapkan pada serial Maxton Hall melalui teknologi Lip-sync yang diperkenalkan Prime Video pada 9 September 2026.
Teknologi ini dirancang agar dialog dalam bahasa dubbing terasa lebih menyatu dengan gerakan mulut aktor di layar. Dengan begitu, penonton tidak terlalu terganggu oleh perbedaan antara suara dan visual ketika mengikuti cerita.
AI Bekerja di Balik Dubbing
Dalam penerapannya, AI tidak digunakan untuk menggantikan pengisi suara manusia. Audio dubbing tetap dibuat melalui proses lokalisasi yang melibatkan voice actor, dubbing director, penerjemah, dan tenaga profesional lainnya.
AI dan VFX digunakan untuk menyesuaikan visual pada bagian gerakan mulut sehingga lebih selaras dengan dialog yang sudah direkam.
Prime Video menyebut proses tersebut dilakukan dengan pengawasan kreatif untuk menjaga agar hasil akhirnya tetap sesuai dengan visi pembuat film.
Vice President of Technology di Prime Video dan Amazon MGM Studios, Raf Soltanovich, mengatakan teknologi ini dikembangkan untuk membuat konten global lebih mudah dinikmati tanpa menghilangkan kendali kreatif pembuatnya.
“Melalui teknologi Lip-syncing, kami menghadirkan pengalaman menonton yang lebih imersif dan menyeluruh bagi pelanggan untuk menikmati konten global,” ujar Raf dalam keterangan resminya, Rabu (23/9/2026).
Menurutnya, teknologi tersebut juga membantu cerita menjangkau audiens yang lebih luas, sementara keputusan kreatif tetap berada di bawah pengawasan tim pembuat konten.
Maxton Hall Jadi Uji Perdana
Teknologi Lip-sync tersebut pertama kali diluncurkan pada Maxton Hall, serial Original Internasional yang disebut sebagai serial Original internasional paling banyak ditonton di Prime Video hingga saat ini.
Untuk Maxton Hall musim pertama dan kedua, versi dubbing dengan teknologi Lip-sync telah tersedia secara global dalam bahasa Inggris.
Teknologi yang sama juga akan digunakan pada Maxton Hall musim ketiga, yang menjadi musim terakhir serial tersebut dan dijadwalkan tayang eksklusif pada 9 Desember 2026.
Ke depannya, teknologi ini direncanakan diperluas ke lebih banyak judul. Artinya, penggunaan AI bukan hanya diarahkan untuk membuat proses produksi lebih cepat, tetapi juga mengatasi salah satu persoalan klasik dalam distribusi konten lintas bahasa.

Voice Actor Tetap Dibutuhkan
Meski menggunakan AI, teknologi Lip-sync tidak menggantikan tenaga manusia dalam proses dubbing.
Sebaliknya, penerapannya justru membutuhkan pengawasan tambahan untuk memastikan hasil akhir tetap berkualitas.
Selain voice actor, dubbing director, dan penerjemah, proses ini melibatkan peran seperti QA review dan VFX supervision.
Prime Video juga menilai akses yang lebih luas terhadap konten berbahasa non-Inggris berpotensi meningkatkan permintaan terhadap tayangan dari berbagai negara.
Dengan kata lain, AI digunakan untuk menjembatani perbedaan bahasa dan visual, bukan menghilangkan seluruh proses kreatif manusia.
AI Mulai Masuk ke Pengalaman Menonton
Penerapan teknologi Lip-sync menunjukkan bahwa pemanfaatan AI di industri hiburan tidak selalu terlihat dalam bentuk fitur yang langsung digunakan penonton.
Dalam kasus ini, AI bekerja di balik layar untuk memperbaiki detail kecil yang bisa memengaruhi kenyamanan saat menonton.
Ketika dubbing dan gerakan mulut terasa lebih selaras, penonton dapat lebih fokus pada cerita tanpa terus menyadari bahwa dialog yang terdengar berasal dari bahasa berbeda.