谷歌于近日正式发布了新一代多模态AI模型Gemini 2.5 Pro,该模型在推理、编码及多模态理解方面实现了显著突破。据官方介绍,Gemini 2.5 Pro在多项基准测试中表现优异,尤其是在复杂数学、科学问题及代码生成任务上,其性能已超越前代模型及部分竞品。
该模型采用全新的混合架构,能够更高效地处理文本、图像、音频和视频等多种输入形式,并支持长达100万token的上下文窗口,极大增强了长文档分析与跨模态信息整合能力。谷歌表示,Gemini 2.5 Pro已集成至旗下多款产品,并面向开发者开放API,旨在推动AI在科研、教育及企业级应用中的落地。