1月20日,DeepSeek正式发布并开源其最新推理模型DeepSeek-R1,该模型在数学、代码及各类推理任务上的表现与OpenAI的o1模型正式版不相上下。DeepSeek-R1采用强化学习技术,即便极少使用标注数据,也能大幅提升推理能力,其性能在数学、代码等领域表现突出。
在多项基准测试中,DeepSeek-R1展现出了卓越的性能。在AIME 2024数学竞赛中,DeepSeek-R1的Pass@1准确率达到79.8%,略高于OpenAI o1-0912的79.2%;在Codeforces编程竞赛中,其Elo评分达到2029,超过96.3%的人类参赛者。此外,DeepSeek-R1在MATH-500中得分97.3%,在MMLU中得分90.8%,在SWE-bench Verified中得分71.7%,均优于或持平于o1系列模型。
DeepSeek-R1采用MIT许可协议,允许用户自由使用、修改和商用。DeepSeek还推出了六个蒸馏版本的小模型,其中基于Llama和Qwen架构的模型在多项基准测试中同样表现出色。API价格方面,DeepSeek-R1的输入缓存命中费用为每百万tokens 1元,输出费用为每百万tokens 16元。
咨询
咨询