Descripción
Gemma 3n de Google DeepMind es un modelo multimodal abierto de última generación diseñado para el rendimiento y la eficiencia en el dispositivo. Está diseñado para ejecutarse localmente en teléfonos, tabletas y laptops, convirtiéndolo en una herramienta poderosa para los desarrolladores que buscan crear aplicaciones inteligentes que respeten la privacidad del usuario y funcionen sin conexión. El modelo fue desarrollado en colaboración con los principales fabricantes de hardware móvil y comparte arquitectura con el Gemini Nano, empoderando una nueva ola de aplicaciones inteligentes en el dispositivo.
Gemma 3n está optimizado para velocidad y calidad, presentando una huella de memoria significativamente reducida. Ofrece un uso dinámico de recursos con una huella de memoria activa de 4B y un submodelo de memoria activa anidado de 2B, permitiendo compensaciones entre calidad y latencia. Esto lo hace adecuado para crear aplicaciones interactivas en vivo que entienden y responden a señales visuales y de audio en tiempo real del entorno del usuario.
El modelo soporta comprensión multimodal, procesando audio, texto, imágenes y videos, y es capaz de realizar tanto transcripción como traducción. Los desarrolladores pueden construir aplicaciones avanzadas centradas en audio, incluyendo transcripción de voz en tiempo real, traducción e interacciones ricas impulsadas por voz. Gemma 3n puede ejecutarse con la API de Gemini y Google AI Edge, permitiendo que los modelos de lenguaje grande operen completamente en el dispositivo.
Gemma 3n está disponible para descarga en plataformas como Hugging Face, Ollama, Kaggle y LM Studio, proporcionando a los desarrolladores las herramientas necesarias para comenzar a construir aplicaciones innovadoras.
Aspectos destacados de Gemma 3n
Rendimiento optimizado en el dispositivo
Privacidad primero, listo para trabajar sin conexión
Comprensión multimodal
Uso dinámico de recursos
Aplicaciones interactivas en vivo
Aplicaciones avanzadas centradas en audio
Transcripción de voz en tiempo real
Integración con la API de Gemini
Compatibilidad con Google AI Edge
Colaboración con fabricantes de hardware móvil
Primeros pasos con Gemma 3n
Descargar: Accede a Gemma 3n desde Hugging Face u otras plataformas
Configurar: Configura el modelo en tu dispositivo
Desarrollar: Construye aplicaciones utilizando entradas multimodales
Desplegar: Ejecuta aplicaciones con la API de Gemini y Google AI Edge
Optimizar: Ajusta la huella de memoria para compensaciones entre calidad y latencia
Casos de uso de Gemma 3n
- Transcripción en tiempo real
- Aplicaciones que priorizan la privacidad
- Procesamiento multimodal
- Aplicaciones sin conexión
- Experiencias interactivas












