谷歌于3月12日正式发布Gemma 3系列多模态模型,这是其开源模型家族的最新升级。Gemma 3提供多种参数版本,其中最大版本拥有270亿参数,并针对单GPU和TPU进行了优化,支持高达128K的上下文窗口,能够处理文本和图像输入,输出文本。

该系列模型在性能上表现亮眼,据谷歌介绍,Gemma 3在Chatbot Arena等基准测试中超越了部分竞品,并支持超过140种语言,包括中文、英文等。此外,Gemma 3还引入了函数调用和代理能力,为开发者构建AI代理应用提供了便利。

谷歌强调,Gemma 3在安全性和责任性方面也进行了加强,并提供了开源工具,以支持开发者在多种硬件上部署模型。此次发布标志着谷歌在开源AI领域的持续投入,旨在推动多模态AI技术的普及和应用。