谷歌近日正式发布Gemma 2系列轻量级AI模型,包括9B和27B两种参数规模。该模型基于与Gemini相同的研究与技术构建,性能显著提升,27B版本在同等规模模型中表现最优,甚至超越部分更大模型。Gemma 2支持高效推理,可在单张NVIDIA H100 GPU或TPU上运行,大幅降低部署成本。

Gemma 2采用全新架构设计,包括滑动窗口注意力机制、Logit软上限等技术,并支持高达8K tokens的上下文长度。谷歌同时开源了模型权重、推理代码及安全工具,推动AI民主化。目前Gemma 2已在Kaggle、Hugging Face等平台开放下载,并针对Google Cloud、AMD、NVIDIA等主流平台进行优化。