Google telah mengembangkan model AI generasi video baru yang disebut Lumiere, yang menggunakan model difusi yang disebut Space-Time-U-Net (STUNet). Model ini memungkinkan Lumiere untuk menentukan lokasi objek dalam video dan bagaimana objek tersebut bergerak dan berubah dari waktu ke waktu. Tidak seperti metode lain yang menyatukan bingkai-bingkai foto, Lumiere membuat video dalam satu proses. Dimulai dengan membuat bingkai dasar dan kemudian menggunakan STUNet untuk memperkirakan pergerakan objek, menciptakan gerakan yang mulus. Lumiere menghasilkan 80 frame dibandingkan dengan 25 frame dari para pesaingnya. Lumiere dari Google merupakan kemajuan yang signifikan dalam pembuatan video AI, semakin mendekati video yang realistis. Lumiere bersaing dengan platform seperti Runway dan Stable Video Diffusion. Lumiere juga menawarkan fitur-fitur seperti pembuatan gambar-ke-video, pembuatan bergaya, cinemagraph, dan inpainting. Namun, ada kekhawatiran tentang potensi penyalahgunaan teknologi ini, dan Google mengakui perlunya alat untuk mendeteksi bias dan kasus penggunaan yang berbahaya.
