Deskripsi
Gemma 3n oleh Google DeepMind adalah model multimodal terbuka yang mutakhir yang dirancang untuk kinerja dan efisiensi di perangkat. Model ini dirancang untuk dijalankan secara lokal di ponsel, tablet, dan laptop, menjadikannya alat yang kuat bagi pengembang yang ingin menciptakan aplikasi cerdas yang menghormati privasi pengguna dan dapat berfungsi secara offline. Model ini dikembangkan bekerja sama dengan produsen perangkat keras mobile terkemuka dan berbagi arsitektur dengan Gemini Nano, memberdayakan gelombang baru aplikasi cerdas yang berjalan di perangkat.
Gemma 3n dioptimalkan untuk kecepatan dan kualitas, dengan jejak memori yang secara signifikan dikurangi. Model ini menawarkan penggunaan sumber daya yang dinamis dengan jejak memori aktif 4B dan submodel memori aktif bersarang 2B, memungkinkan trade-off kualitas-latensi. Ini membuatnya cocok untuk menciptakan aplikasi interaktif langsung yang memahami dan merespons isyarat visual dan audio waktu nyata dari lingkungan pengguna.
Model ini mendukung pemahaman multimodal, memproses audio, teks, gambar, dan video, serta mampu melakukan transkripsi dan terjemahan. Pengembang dapat membangun aplikasi yang berfokus pada audio yang canggih, termasuk transkripsi ucapan waktu nyata, terjemahan, dan interaksi berbasis suara yang kaya. Gemma 3n dapat dijalankan dengan API Gemini dan Google AI Edge, memungkinkan model bahasa besar beroperasi sepenuhnya di perangkat.
Gemma 3n tersedia untuk diunduh di platform seperti Hugging Face, Ollama, Kaggle, dan LM Studio, memberikan pengembang alat yang diperlukan untuk mulai membangun aplikasi inovatif.
Sorotan Gemma 3n
Kinerja di perangkat yang dioptimalkan
Mengutamakan privasi, siap offline
Pemahaman multimodal
Penggunaan sumber daya dinamis
Aplikasi interaktif langsung
Aplikasi berfokus audio yang canggih
Transkripsi ucapan waktu nyata
Integrasi API Gemini
Kompatibilitas Google AI Edge
Kolaborasi dengan produsen perangkat keras mobile
Memulai dengan Gemma 3n
Unduh: Akses Gemma 3n dari Hugging Face atau platform lainnya
Konfigurasi: Siapkan model di perangkat Anda
Kembangkan: Bangun aplikasi menggunakan input multimodal
Terapkan: Jalankan aplikasi dengan API Gemini dan Google AI Edge
Optimalkan: Sesuaikan jejak memori untuk trade-off kualitas-latensi
Kasus Penggunaan Gemma 3n
- Transkripsi waktu nyata
- Aplikasi yang mengutamakan privasi
- Pemrosesan multimodal
- Aplikasi offline
- Pengalaman interaktif












