Google于2025年3月12日正式发布Gemma 3系列多模态模型,这是其轻量级开源模型家族的重大升级。新模型支持文本与图像输入,可处理高达128K的上下文窗口,并支持140种语言,显著提升了多语言处理能力。此外,Gemma 3还引入了函数调用与结构化输出功能,为开发者提供了更灵活的工具集成选项。

Gemma 3提供多种参数版本(1B、4B、12B、27B),以适应不同部署场景。其中,27B版本在性能上对标Gemini Pro,而4B版本则优化了单GPU运行效率。Google宣称,Gemma 3在多个基准测试中表现出色,尤其在多语言、数学推理和视觉理解方面超越同类模型。

值得注意的是,Gemma 3还支持在NVIDIA GPU和Google TPU上运行,并兼容Hugging Face Transformers、JAX等主流框架。Google表示,Gemma 3的开放权重设计旨在推动AI民主化,使开发者能够构建跨设备、跨语言的智能应用,同时通过其安全分类器降低滥用风险。