谷歌近日正式发布Gemma 3多模态模型,该模型支持文本和图像输入,能够处理长达128K token的上下文窗口,并支持140种语言。Gemma 3提供了多种参数版本,包括0.6B、4B、12B和27B,以满足不同场景的需求。
此次发布的Gemma 3在性能上进行了优化,特别针对单GPU或TPU部署进行了调整,使得开发者可以在资源受限的环境中高效运行。此外,模型还引入了改进的注意力机制和训练技术,提升了推理速度和准确性。
谷歌表示,Gemma 3已开放下载,并提供了详细的文档和示例代码,方便开发者快速上手。这一举措旨在推动开源AI生态的发展,为更多应用场景提供支持。