首页 AI快讯 谷歌发布Gemma 2轻量级AI模型,性能卓越可单GPU运行

谷歌发布Gemma 2轻量级AI模型,性能卓越可单GPU运行

希鸥网AIGC专员
· 2026-07-20 · AI快讯 · 来源:INFOQ 1,324 次阅读

谷歌近日正式发布Gemma 2系列轻量级AI模型,包括9B和27B两种参数规模。该模型基于与Gemini相同的研究与技术构建,性能显著提升,27B版本在同等规模模型中表现最优,甚至超越部分更大模型。Gemma 2支持高效推理,可在单张NVIDIA H100 GPU或TPU上运行,大幅降低部署成本。

Gemma 2采用全新架构设计,包括滑动窗口注意力机制、Logit软上限等技术,并支持高达8K tokens的上下文长度。谷歌同时开源了模型权重、推理代码及安全工具,推动AI民主化。目前Gemma 2已在Kaggle、Hugging Face等平台开放下载,并针对Google Cloud、AMD、NVIDIA等主流平台进行优化。

📖 阅读本文共 1,324 2026年07月20日 11:40
📱 长按识别 分享给好友~
💬 咨询客服 💬 客服