
Ringkas: Gemini Omni 1.1 Flash dari Google dapat memperpanjang video hingga 40 detik, membuat pratinjau 360p lebih cepat dan murah, serta menghasilkan video hingga 4K.

Membuat video AI pendek adalah satu hal, tetapi menjaga beberapa adegan agar terlihat berasal dari video yang sama jauh lebih sulit. Google mencoba mengatasi masalah tersebut melalui Gemini Omni 1.1 Flash, model video generatif terbaru yang memberi kreator dan pengembang kendali lebih besar atas kejadian di antara frame pertama dan terakhir.
Gemini Omni 1.1 Flash mengingat hingga 10 detik video
Perubahan terbesar pada Gemini Omni 1.1 adalah kemampuannya memahami lebih banyak bagian dari video yang sudah ada ketika diminta melanjutkan sebuah adegan. Model ini dapat melihat hingga 10 detik rekaman sebelumnya sebagai konteks, bukan hanya satu detik terakhir.
Kemampuan tersebut seharusnya membantu Gemini menjaga karakter, lingkungan, dan arah umum adegan agar lebih konsisten. Dengan begitu, model tidak sekadar menebak apa yang mungkin terjadi berikutnya.
Video AI dapat diperpanjang hingga 40 detik

Google juga memberikan ruang lebih besar bagi kreator untuk melanjutkan adegan. Video dapat diperpanjang dalam segmen 10 detik hingga mencapai durasi total 40 detik. Durasi ini memang belum panjang jika dibandingkan dengan video tradisional, tetapi cukup membuka peluang untuk membuat rangkaian video AI dengan awal, tengah, dan akhir yang lebih jelas.
Kreator juga dapat memberikan frame pertama dan frame terakhir yang diinginkan untuk sebuah shot. Gemini kemudian menghasilkan bagian yang diperlukan untuk menghubungkan keduanya. Fitur ini dapat digunakan untuk membuat pergerakan kamera mengelilingi subjek, memperhalus perpindahan zoom antar-komposisi, atau membuat klip berulang tanpa lompatan yang terlihat.
Gemini juga mendukung referensi video. Pengguna dapat memasukkan rekaman yang sudah ada hingga tiga detik untuk memberikan konteks visual tambahan. Menurut Google, hal ini dapat membantu mempertahankan elemen seperti penampilan karakter di antara adegan yang dihasilkan.
Pratinjau 360p lebih cepat, hasil akhir hingga 4K
Tidak semua eksperimen perlu dimulai dengan kualitas maksimum. Salah satu tambahan praktis pada Omni 1.1 memungkinkan pengembang membuat pratinjau 360p yang menurut Google hingga 60% lebih cepat dibandingkan keluaran 720p regulernya, dengan biaya sekitar sepertiganya.
Hal ini memudahkan pengguna menguji ide, menyesuaikan prompt, atau mencoba beberapa versi sebelum menghabiskan lebih banyak waktu dan biaya untuk hasil akhir. Setelah hasilnya sesuai, Omni 1.1 dapat menghasilkan video 1080p atau meningkatkan resolusi video jadi hingga 4K.

Google telah menyediakan Omni 1.1 Flash bagi pengembang melalui Gemini API di Google AI Studio. Bisnis dapat mengaksesnya melalui Google enterprise Agent Platform.
Pengguna tidak harus selalu membuat aplikasi untuk mencoba sebagian fitur tersebut. Omni 1.1 mulai diluncurkan secara global di Google Flow untuk pelanggan AI Plus, Pro, dan Ultra. Fitur perpanjangan adegan juga akan hadir langsung di aplikasi Gemini bagi pelanggan tersebut, sehingga kemampuan baru model ini lebih mudah dicoba.

Shimul adalah kontributor Digital Trends dengan pengalaman lebih dari lima tahun di bidang teknologi.
Artikel terkait dari Emerging Tech
Mengapa pola pikir insinyur penting bagi anak-anak di era AI

Salah satu hadiah terbaik yang dapat diberikan kepada anak adalah pengalaman mengalami kegagalan. Gagasan ini mungkin terdengar radikal atau tidak nyaman, terutama karena banyak orang tua berusaha melindungi anak dari frustrasi dan kekecewaan. Namun, setiap kali orang dewasa turun tangan saat sesuatu menjadi sulit, anak juga dapat kehilangan kesempatan untuk mengembangkan keterampilan yang dibutuhkan dalam menghadapi dunia yang semakin sulit diprediksi.
Pertanyaan tersebut menjadi semakin penting ketika kecerdasan buatan mengubah cara manusia memandang pekerjaan. Dalam percakapan Trending Forward sebelumnya, dibahas apa yang terjadi ketika AI mulai mengambil alih tugas dan keterampilan yang sebelumnya membutuhkan pelatihan bertahun-tahun. Tantangannya bukan hanya memperkirakan pekerjaan mana yang mungkin hilang, tetapi juga menyiapkan manusia menghadapi pasar kerja ketika keterampilan yang bernilai saat ini mungkin tidak lagi sama nilainya satu atau dua dekade mendatang.
Microduck dari Pollen Robotics ingin membuat pelatihan AI fisik lebih murah
Microduck adalah robot bipedal kecil seharga $399 yang dibuat agar pengembang dapat bereksperimen dengan AI fisik. Robot ini menawarkan cara yang lebih terjangkau untuk melatih dan menguji perilaku robot baru tanpa mempertaruhkan perangkat keras yang mahal.

Pollen Robotics dan Hugging Face kembali menghadirkan robot baru bernama Microduck. Robot bipedal setinggi 25 sentimeter ini dibuat untuk membawa AI dari layar ke meja pengguna. Preorder dibuka hari ini, dengan pengiriman pertama ditargetkan sebelum Natal 2026.
Berbeda dari pendahulunya, Reachy Mini, Microduck sepenuhnya berfokus pada aksi. Robot ini menggunakan 15 motor, paruh berartikulasi untuk mengambil benda, kamera, sensor kedalaman, dua IMU, serta kemampuan menjaga keseimbangan untuk berjalan, berjongkok, dan bahkan bermain sepatu roda.
Claude kini mengingat informasi pengguna di berbagai layanan
Claude kini dapat mengingat informasi selama percakapan dan membawanya ke Cowork. Pengguna dapat memeriksa, mengedit, atau menghapus memori tertentu.

Salah satu hal yang mengganggu saat bekerja dengan asisten AI adalah keharusan menjelaskan kembali konteks dari awal. Claude berusaha mengatasi masalah tersebut. Mulai hari ini, memori yang digunakan Claude dalam chat juga tersedia di Claude Cowork, sehingga konteks yang dibangun selama berbulan-bulan percakapan dapat ikut terbawa ketika pengguna memberikan tugas kepada Claude.
Dengan demikian, Claude dapat mengetahui proyek, prioritas, dan preferensi pengguna tanpa memerlukan penjelasan panjang baru. Misalnya, jika pengguna menjelaskan melalui chat cara timnya menetapkan metrik, Cowork dapat memakai informasi tersebut saat menyusun tinjauan bisnis kuartalan berikutnya. Jika pengguna membahas sebuah konferensi melalui chat, Cowork dapat membawa detail seperti kota, pembicara, dan jumlah peserta ketika mengerjakan logistiknya.
Gemini Omni 1.1 Flash menghadirkan kontrol konteks yang lebih besar untuk perpanjangan adegan, opsi pratinjau yang lebih hemat, serta keluaran video hingga 4K. Model ini tersedia bagi pengembang melalui layanan Google dan mulai diluncurkan di Google Flow serta aplikasi Gemini untuk pelanggan tertentu.
Poin penting
- Gemini Omni 1.1 Flash
- Video diperpanjang hingga 40 detik
- Konteks video hingga 10 detik
- Pratinjau 360p hingga 60% lebih cepat
- Upscaling video hingga 4K
- Akses melalui Gemini API