谷歌于3月12日正式发布Gemma 3系列模型,这是其轻量级开源模型系列的重大更新。Gemma 3提供从1B到27B的多种参数版本,支持多模态输入(文本与图像)和140多种语言,并具备8K上下文窗口(可扩展至128K)。该系列模型在性能上表现出色,据谷歌宣称,其27B模型在Chatbot Arena排行榜上得分高达1338,仅次于GPT-4o等大型专有模型,超越了部分更大规模的模型。

Gemma 3针对单GPU或TPU部署进行了优化,支持量化版本,可在消费级硬件上高效运行。同时,模型引入了改进的注意力机制和蒸馏技术,提升了推理效率和指令遵循能力。此外,Gemma 3还支持函数调用和结构化输出,便于开发者构建智能体应用。谷歌同步推出了AI Edge SDK和Gemma Cookbook等工具,以简化开发流程。

值得注意的是,Gemma 3系列包含专门针对NVIDIA GPU优化的版本,并计划在Google Cloud上提供全面支持。此举进一步巩固了谷歌在开源大模型领域的竞争地位,为开发者和企业提供了高性能、低门槛的AI解决方案。