Langsung ke konten utama
ToolPotion

daVinci-MagiHuman

daVinci-MagiHuman adalah model AI sumber terbuka yang mengubah satu foto potret ditambah skrip atau audio menjadi video berbicara yang disinkronkan dengan gerakan bibir, menghasilkan audio dan video yang selaras dalam satu proses. Ini dapat dicoba secara gratis secara online atau di-host sendiri.

Kunjungi URL
daVinci-MagiHuman screenshot

Deskripsi

daVinci-MagiHuman adalah model AI sumber terbuka dengan 15 miliar parameter yang menghasilkan video berbicara yang disinkronkan dengan gerakan bibir dari satu foto. Anda mengunggah potret, menambahkan skrip atau audio, dan mendapatkan klip berbicara yang alami di mana audio dan video dihasilkan bersama-sama daripada dijahit dari jalur terpisah. Model ini dikembangkan oleh Sand.ai dan GAIR Lab (Universitas Jiao Tong Shanghai) dan dirilis di bawah lisensi Apache 2.0, sehingga bobotnya dapat diperiksa, dijalankan secara lokal, dan digunakan secara komersial sesuai dengan lisensi.

Model ini menggunakan Transformer aliran tunggal yang secara bersamaan menghilangkan noise dari token video dan audio dengan latent gambar referensi, menghasilkan output audio-video yang terpadu dari foto wajah ditambah teks atau audio. Pada satu GPU NVIDIA H100, ia dapat menghasilkan klip pendek 256p dalam waktu sekitar dua detik, dan evaluasi yang dipublikasikan melaporkan tingkat kesalahan kata yang kuat dan preferensi manusia yang tinggi dibandingkan dengan baseline seperti Ovi 1.1 dan LTX 2.3.

Pengguna dapat mencobanya melalui demo online gratis, mengunduh checkpoint dari Hugging Face, atau mengkloning repositori GitHub untuk di-host sendiri dan menjalankan inferensi dengan pengaturan dan resolusi kustom hingga 1080p. Ini mendukung beberapa bahasa untuk sinkronisasi bibir tergantung pada data pelatihan yang dirilis.

Layanan yang di-host menawarkan tingkat gratis dengan kredit pemula dan check-in harian (penyimpanan sementara 15 hari) ditambah rencana kredit Basic, Pro, dan Max yang menambahkan generasi HD, pemrosesan prioritas, penyimpanan aset permanen, dan hak penggunaan komersial.

Fitur Inti daVinci-MagiHuman

  • Generasi video berbicara dari satu foto dengan sinkronisasi bibir

  • Audio dan video yang disatukan dihasilkan bersama dalam satu proses model

  • Arsitektur Transformer aliran tunggal dengan 15B parameter

  • Sumber terbuka di bawah lisensi Apache 2.0

  • Inferensi cepat (~2 detik untuk klip 256p ~2 detik pada H100)

  • Sinkronisasi bibir multibahasa tergantung pada data pelatihan

  • Hosting sendiri melalui Hugging Face dan GitHub, atau demo online yang di-host

  • Resolusi output hingga 1080p

Cara menggunakan daVinci-MagiHuman?

  1. Unggah potret: Tambahkan foto wajah yang jelas dan menghadap ke depan.

  2. Tambahkan skrip atau audio: Masukkan teks atau unggah file audio untuk menggerakkan ucapan.

  3. Pilih resolusi: Pilih resolusi output seperti 256p, 720p, atau 1080p.

  4. Hasilkan: Jalankan model untuk membuat klip yang disinkronkan dengan gerakan bibir.

  5. Unduh: Simpan video berbicara yang sudah selesai, atau di-host sendiri dari Hugging Face atau GitHub.

Kasus Penggunaan daVinci-MagiHuman

  • Video avatar berbicara
  • Generasi yang di-host sendiri
  • Dubbing multibahasa
  • Penelitian dan benchmarking
  • Pembuatan konten

FAQ dari daVinci-MagiHuman

Ulasan daVinci-MagiHuman

Memuat...

Alat AI Populer Seperti daVinci-MagiHuman

Aplikasi AI

Perusahaan generasi video AI yang mengembangkan keluarga model Magi, termasuk MAGI-2 Preview, model audio-video terpadu yang menghasilkan dialog, nyanyian, dan gerakan kamera…

Generator Video AIMedia & Hiburan

Aplikasi AI

Digen AI adalah generator video AI gratis yang mengubah gambar menjadi video profesional dengan sinkronisasi bibir yang realistis, dukungan multibahasa, dan gerakan cerdas. Ini…

Generator Video AIMedia & Hiburan

Aplikasi AI

Gaga AI adalah generator video AI online dan pembuat avatar dari Sand.ai yang mengubah gambar tunggal dan audio menjadi video berbicara sinematik dengan sinkronisasi bibir yang…

Generator Video AI

Aplikasi AI

Seedance 2.0 adalah generator video AI multimodal terpadu yang mengubah teks, gambar, audio, atau referensi video menjadi klip sinematik 1080p dengan sinkronisasi bibir asli,…

Generator Video AIMedia & Hiburan

Aplikasi AI

ClipDance adalah platform pembuatan video AI yang mengubah teks dan gambar menjadi video sinematik 1080p dengan audio sinkronisasi asli, didukung oleh Seedance 2.0 dan model-model…

Generator Video AIMedia & Hiburan

Aplikasi AI

LumeFlow AI adalah platform video dan gambar AI serba ada yang mengubah teks, gambar, atau video menjadi klip berkualitas tinggi menggunakan lebih dari 20 model, dengan…

Generator Video AIAgensi Pemasaran & Kreatif

Aplikasi AI

Monet AI adalah platform kreasi visual serba ada yang menyatukan lebih dari 20 model video, gambar, dan audio terkemuka dalam satu akun, memungkinkan kreator untuk menghasilkan…

Generator Video AIAgensi Pemasaran & Kreatif

Aplikasi AI

LipsyncX adalah generator video lip-sync berbasis AI yang mengubah foto, video, skrip, dan suara menjadi foto berbicara, klip dubbing, video bernyanyi, dan video avatar…

Generator Video AIMedia & Hiburan