谷歌于3月12日正式发布Gemma 3系列多模态AI模型,旨在为开发者提供可在单张GPU或TPU上运行的高性能开源模型。该系列包括四种参数规模(4B、12B、27B和27B-SI),其中27B模型在MMLU等基准测试中表现优异,性能超越Meta的Llama-405B和OpenAI的GPT-4o,同时保持高效推理能力。Gemma 3支持文本和视觉输入,可处理最长128K token的上下文窗口,并新增对140种语言的支持及函数调用功能,便于开发者构建工具调用和智能体应用。

Gemma 3模型采用量化感知训练,支持TensorFlow、JAX、PyTorch等主流框架,并可通过Hugging Face、Ollama等平台获取。谷歌还提供了AI Edge等工具链,使开发者能够在移动端和边缘设备上优化模型部署。此外,Gemma 3在安全性和合规性方面进行了增强,内置责任AI工具包,帮助开发者规避潜在风险。此次发布延续了Gemma系列的开源策略,旨在吸引更多开发者构建AI应用,巩固谷歌在开源模型生态中的竞争力。