谷歌于近日正式发布Gemma 2系列,这是其轻量级开源模型的重要升级。Gemma 2提供2B、9B和27B三种参数规模,其中27B版本在性能上超越参数量更大的Llama 2 70B,展现出极高的效率。该系列模型针对文本生成任务优化,支持在单张GPU或TPU上运行,极大降低了部署门槛。

Gemma 2采用多项创新技术,包括分组查询注意力(GQA)和滑动窗口注意力机制,以提升推理速度和长文本处理能力。同时,谷歌在训练中使用了知识蒸馏技术,让小型模型从大型教师模型学习,从而在较小规模下实现更优性能。开发者可通过Hugging Face等平台获取模型权重,并用于商业应用。

此次发布标志着谷歌在开源AI领域的进一步发力,旨在为开发者提供高效、易用的工具,推动AI应用的普及。Gemma 2的推出也体现了轻量化模型在降低计算成本、扩大使用场景方面的重要趋势。