Langsung ke konten utama
ToolPotion

LGM: Large Multi-View Gaussian Model

LGM adalah implementasi resmi dari Large Multi-View Gaussian Model untuk pembuatan konten 3D beresolusi tinggi. Ini memungkinkan pembuatan aset 3D yang detail dari gambar multi-tampilan, dengan aplikasi dalam alur kerja text-to-3D dan image-to-3D. Proyek ini menyediakan kode, bobot pra-terlatih, dan skrip inferensi.

Kunjungi URL

Deskripsi

LGM, singkatan dari Large Multi-View Gaussian Model, adalah kerangka kerja canggih yang dirancang untuk pembuatan konten 3D beresolusi tinggi. Proyek ini, yang dipresentasikan di ECCV 2024 sebagai makalah Oral, menawarkan implementasi yang kuat dari model Gaussian baru yang mampu menghasilkan aset 3D yang detail dari beberapa tampilan masukan. Inti dari LGM terletak pada kemampuannya untuk memanfaatkan informasi multi-tampilan untuk merekonstruksi dan merender adegan 3D yang kompleks dengan fidelitas yang mengesankan.

Proyek ini menyediakan seperangkat alat yang komprehensif bagi para peneliti dan pengembang yang tertarik pada pembuatan konten 3D. Ini termasuk repositori kode resmi, bobot model pra-terlatih yang tersedia untuk diunduh, dan instruksi yang jelas untuk inferensi. LGM mendukung pipeline generasi text-to-3D dan image-to-3D, menjadikannya alat yang serbaguna untuk berbagai aplikasi kreatif dan teknis. Implementasi ini dibangun di atas penelitian yang ada dalam teknik Gaussian splatting dan neural rendering, yang bertujuan untuk mendorong batas kualitas dan resolusi dalam sintesis 3D.

Kemampuan utama LGM meliputi keluaran beresolusi tinggi, yang memungkinkan pembuatan model dan adegan 3D yang detail. Arsitektur model dioptimalkan untuk masukan multi-tampilan, memungkinkan rekonstruksi geometri dan penampilan yang akurat. Proyek ini juga menawarkan GUI lokal untuk memvisualisasikan file PLY yang disimpan dan skrip untuk konversi mesh, memfasilitasi integrasi yang lebih mudah ke dalam alur kerja 3D yang ada. Meskipun dataset pelatihan berbasis AWS dan tidak dapat ditransfer secara langsung, proyek ini menyediakan kerangka kerja kode pelatihan dan subset yang difilter dari dataset Objaverse bagi pengguna yang ingin melatih model mereka sendiri.

LGM sangat relevan bagi para peneliti di bidang visi komputer dan grafis, seniman 3D, pengembang game, dan siapa pun yang terlibat dalam membuat atau memanipulasi aset 3D. Sifat open-source proyek dan dokumentasi terperinci mendorong kontribusi komunitas dan pengembangan lebih lanjut. Penekanan pada keluaran beresolusi tinggi dan konsistensi multi-tampilan memposisikan LGM sebagai kemajuan signifikan dalam bidang pemodelan 3D generatif.

Fitur Inti LGM: Large Multi-View Gaussian Model

  • Pembuatan konten 3D beresolusi tinggi

  • Implementasi Large Multi-View Gaussian Model

  • Mendukung pembuatan text-to-3D

  • Mendukung pembuatan image-to-3D

  • Kode resmi dan bobot pra-terlatih disediakan

  • Termasuk skrip inferensi

  • GUI lokal untuk visualisasi model 3D

  • Utilitas konversi mesh

  • Dibangun di atas teknik Gaussian Splatting

  • Makalah Oral ECCV 2024

Memulai dengan LGM: Large Multi-View Gaussian Model

  1. Kloning repositori: Dapatkan kode LGM dari GitHub.

  2. Instal dependensi: Siapkan paket Python yang diperlukan, termasuk PyTorch dan xformers.

  3. Unduh bobot: Dapatkan checkpoint model pra-terlatih dari Hugging Face.

  4. Konfigurasi inferensi: Tentukan jalur workspace dan test untuk generasi.

  5. Jalankan inferensi: Jalankan skrip `infer.py` untuk generasi 3D.

  6. Visualisasikan hasil: Gunakan `gui.py` untuk melihat file PLY yang dihasilkan.

  7. Konversi ke mesh: Gunakan `convert.py` untuk ekstraksi mesh.

Kasus Penggunaan LGM: Large Multi-View Gaussian Model

  • Pembuatan aset 3D beresolusi tinggi
  • Pembuatan konten Text-to-3D
  • Rekonstruksi Image-to-3D
  • Konten 3D untuk AR/VR
  • Aset pengembangan game
  • Penelitian dalam 3D generatif

FAQ dari LGM: Large Multi-View Gaussian Model

Ulasan LGM: Large Multi-View Gaussian Model

Memuat...

Alat AI Populer Seperti LGM: Large Multi-View Gaussian Model

Repositori GitHub AI

GaussianObject adalah kerangka kerja untuk rekonstruksi objek 3D berkualitas tinggi hanya dari empat tampilan menggunakan Gaussian splatting. Ini menggabungkan teknik visual hull…

Generator Model 3D

Repositori GitHub AI

MVDream adalah model difusi untuk generasi 3D multi-view, dibangun di atas Stable Diffusion. Ini memungkinkan pembuatan beberapa gambar 2D dari sudut pandang yang berbeda,…

Generator Model 3D

Repositori GitHub AI

Shap-E adalah model AI open-source dari OpenAI yang menghasilkan objek 3D. Model ini dapat membuat objek tersebut berdasarkan prompt teks atau gambar masukan. Alat ini dirancang…

Generator Model 3D

Repositori GitHub AI

Stable-DreamFusion adalah implementasi PyTorch dari model teks-ke-3D DreamFusion, yang memanfaatkan Stable Diffusion untuk pembuatan konten 3D. Ini mendukung teks-ke-3D,…

Generator Model 3D

Aplikasi AI

3D AI Studio adalah toolkit AI yang memungkinkan pengguna untuk mengubah teks atau gambar menjadi aset 3D berkualitas tinggi dengan cepat. Sempurna untuk pencipta yang ingin…

Generator Model 3D

Aplikasi AI

Imagen3D adalah alat AI yang mengubah foto menjadi model 3D secara online tanpa memerlukan keterampilan 3D. Ini menghasilkan model yang dapat dilihat dan dibagikan dengan tekstur…

Generator Model 3D

Aplikasi AI

VARCO 3D adalah alat bertenaga AI yang memungkinkan pengguna untuk membuat dan menganimasi model 3D berkualitas tinggi dari teks atau gambar. Alat ini dirancang untuk seniman dan…

Generator Model 3D

Aplikasi AI

SAM 3D adalah platform pihak ketiga independen yang membuat model SAM 3D Objects dan SAM 3D Body dari Meta dapat digunakan untuk rekonstruksi 3D dari gambar tunggal, memungkinkan…

Generator Model 3D