Gemma
谷歌推出的新一代轻量级开放模型
Gemma 是什么
Gemma 是 Google DeepMind 推出的开放模型系列,面向希望构建负责任 AI 应用的开发者与研究者。官方将它定位为可在云服务器、笔记本电脑乃至手机上运行的开放模型,并强调在移动设备和物联网设备上的计算与内存效率。它更像一组可按部署环境和任务选择的模型基础,而不是面向普通用户的单一聊天产品。
开发者可以通过官方文档、快速入门和指南开始构建应用,并在 Google AI Edge、Google Cloud、Android、Kaggle、Hugging Face、Keras、Ollama、PyTorch 等平台或工具中探索相应工作流。Gemma 家族还包含面向不同任务的变体,例如侧重文本扩散生成、编码器—解码器理解、医学文本与图像理解,以及内容政策分类的模型。对于需要把模型部署到个人电脑、移动设备、物联网设备或云端的团队,它提供了较宽的形态选择,但具体任务仍应按所选变体的能力和文档说明评估。
Gemma 的主要功能
开放模型基础
Gemma 将模型以开放形态提供给开发者,用于构建不同类型的 AI 应用。官方资料强调其目标是支持负责任的应用开发,适合需要自行设计产品流程和模型集成方式的团队。
跨设备部署
官方将 Gemma 描述为可运行在云服务器、笔记本电脑和手机上的模型系列,并特别展示了面向移动设备与物联网设备的计算和内存效率。用户可以根据部署环境选择更合适的模型形态。
任务型模型变体
Gemma 家族提供多种官方变体,覆盖文本扩散生成、编码器—解码器式上下文理解、医学文本与图像理解,以及检测违规内容的模块化分类。选择变体时,应先对照其公开定位与目标任务。
开发工具与资源
官方提供文档、快速入门、开发指南和开发者论坛,并列出 Google AI Edge、Google Cloud、Android、Kaggle、Hugging Face、Keras、Ollama 与 PyTorch 等平台或工具。它适合希望从实验逐步推进到应用构建的开发者。