被誉为“AI圈春晚”的DeepSeek发布会于今日举行,正式推出其新一代大语言模型DeepSeek-V3。该模型在多项基准测试中表现优异,全面超越GPT-4o,尤其在代码生成、数学推理和多语言理解任务上展现出显著优势。

DeepSeek-V3采用创新的混合专家架构,参数量达到6850亿,但通过稀疏激活机制,实际推理成本仅为同等规模密集模型的1/10。此外,模型训练效率大幅提升,仅用原计划1/3的算力即完成训练,引发业内对算力效率革命的广泛讨论。

目前,DeepSeek已开放API接口,并提供免费试用额度。业界分析认为,这一发布将加速AI应用普惠化,并可能重塑大模型竞争格局。