Description
Gemma 3n de Google DeepMind est un modèle multimodal ouvert à la pointe de la technologie, conçu pour la performance et l'efficacité sur appareil. Il est conçu pour fonctionner localement sur des téléphones, tablettes et ordinateurs portables, en faisant un outil puissant pour les développeurs souhaitant créer des applications intelligentes qui respectent la vie privée des utilisateurs et fonctionnent hors ligne. Le modèle a été développé en collaboration avec des fabricants de matériel mobile de premier plan et partage une architecture avec le Gemini Nano, permettant une nouvelle vague d'applications intelligentes sur appareil.
Gemma 3n est optimisé pour la vitesse et la qualité, avec une empreinte mémoire considérablement réduite. Il offre une utilisation dynamique des ressources avec une empreinte mémoire active de 4 Go et un sous-modèle de mémoire active imbriqué de 2 Go, permettant des compromis entre qualité et latence. Cela le rend adapté à la création d'applications interactives en direct qui comprennent et réagissent aux indices visuels et audio en temps réel de l'environnement de l'utilisateur.
Le modèle prend en charge la compréhension multimodale, traitant l'audio, le texte, les images et les vidéos, et est capable de transcription et de traduction. Les développeurs peuvent créer des applications avancées centrées sur l'audio, y compris la transcription de discours en temps réel, la traduction et des interactions riches pilotées par la voix. Gemma 3n peut être exécuté avec l'API Gemini et Google AI Edge, permettant aux grands modèles de langage de fonctionner complètement sur appareil.
Gemma 3n est disponible en téléchargement sur des plateformes telles que Hugging Face, Ollama, Kaggle et LM Studio, fournissant aux développeurs les outils nécessaires pour commencer à créer des applications innovantes.
Points forts de Gemma 3n
Performance optimisée sur appareil
Axé sur la confidentialité, prêt pour le hors ligne
Compréhension multimodale
Utilisation dynamique des ressources
Applications interactives en direct
Applications avancées centrées sur l'audio
Transcription de discours en temps réel
Intégration de l'API Gemini
Compatibilité avec Google AI Edge
Collaboration avec des fabricants de matériel mobile
Premiers pas avec Gemma 3n
Télécharger : Accédez à Gemma 3n depuis Hugging Face ou d'autres plateformes
Configurer : Configurez le modèle sur votre appareil
Développer : Créez des applications utilisant des entrées multimodales
Déployer : Exécutez des applications avec l'API Gemini et Google AI Edge
Optimiser : Ajustez l'empreinte mémoire pour des compromis qualité-latence
Cas d'utilisation de Gemma 3n
- Transcription en temps réel
- Applications axées sur la confidentialité
- Traitement multimodal
- Applications hors ligne
- Expériences interactives












