Sudah lebih dari setahun sejak OpenAI memperkenalkan Sora, model generatif untuk video dan audio. Kini, perusahaan tersebut resmi menghadirkan pembaruan besar pertamanya melalui Sora 2, yang menawarkan kualitas video lebih realistis, akurasi fisika yang meningkat, kontrol pengguna yang lebih baik, serta kemampuan pengeditan yang lebih canggih.
OpenAI menyebut Sora 2 sebagai momen “setara GPT-3.5”, menandakan lompatan besar dalam kecerdasan generatif. Salah satu peningkatan utama adalah output suara yang lebih baik, lengkap dengan dialog dan efek suara yang tersinkronisasi dengan visual.
Perbaikan Kualitas dan Konsistensi Video
Sora 2 berhasil mengatasi berbagai masalah yang kerap muncul pada model video generatif sebelumnya, seperti:
- Objek yang berubah bentuk (morphing)
- Distorsi fisik yang tidak masuk akal hanya demi menyesuaikan prompt
Model ini juga mampu mengikuti instruksi multi-shot dan menjaga konsistensi antar adegan. Pengguna dapat membuat video dengan berbagai gaya, termasuk:
- Cinematic
- Realistis
- Anime
Aplikasi iOS dan Sistem Undangan
OpenAI juga merilis aplikasi Sora versi iOS sebagai platform terpisah. Untuk saat ini, aksesnya terbatas melalui sistem undangan (invite-only).
Demi keamanan dan etika penggunaan, Sora 2 dilengkapi sejumlah batasan, seperti:
- Larangan menggunakan tokoh publik dalam generasi video
- Fitur “cameo” yang memungkinkan seseorang mengizinkan penggunaan wajah mereka, dengan opsi mencabut izin kapan saja
Ketersediaan, Harga, dan Akses Pro
Peluncuran perdana Sora 2 dimulai hari ini dan hanya tersedia di Amerika Serikat dan Kanada. Untuk tahap awal, layanan ini gratis dengan batas pemakaian yang cukup longgar agar pengguna bisa menjelajahi kemampuannya.
Pelanggan ChatGPT Pro akan mendapatkan akses ke varian Sora 2 Pro yang menawarkan kualitas lebih tinggi. OpenAI juga mengonfirmasi bahwa API Sora 2 akan dirilis dalam waktu dekat.