描述
Gemma 3n 由 Google DeepMind 开发,是一个最先进的开放多模态模型,专为设备端性能和效率而设计。它旨在在手机、平板电脑和笔记本电脑上本地运行,使其成为开发者创建尊重用户隐私并能够离线工作的智能应用的强大工具。该模型与领先的移动硬件制造商合作开发,并与 Gemini Nano 共享架构,推动了一波新的智能设备端应用的浪潮。
Gemma 3n 针对速度和质量进行了优化,具有显著减少的内存占用。它提供动态资源使用,具有 4B 的活动内存占用和嵌套的 2B 活动内存子模型,允许进行质量与延迟的权衡。这使得它适合创建能够理解并响应用户环境中实时视觉和音频提示的实时交互应用。
该模型支持多模态理解,能够处理音频、文本、图像和视频,并具备转录和翻译的能力。开发者可以构建先进的音频中心应用,包括实时语音转录、翻译和丰富的语音驱动交互。Gemma 3n 可以通过 Gemini API 和 Google AI Edge 运行,使大型语言模型能够完全在设备端操作。
Gemma 3n 可在 Hugging Face、Ollama、Kaggle 和 LM Studio 等平台上下载,为开发者提供开始构建创新应用所需的工具。
Gemma 3n亮点
优化的设备端性能
隐私优先,支持离线
多模态理解
动态资源使用
实时交互应用
先进的音频中心应用
实时语音转录
Gemini API 集成
Google AI Edge 兼容性
与移动硬件制造商的合作
Gemma 3n入门
下载:从 Hugging Face 或其他平台获取 Gemma 3n
配置:在您的设备上设置模型
开发:使用多模态输入构建应用
部署:使用 Gemini API 和 Google AI Edge 运行应用
优化:调整内存占用以实现质量与延迟的权衡
Gemma 3n的使用案例
- 实时转录
- 隐私优先的应用
- 多模态处理
- 离线应用
- 交互体验












