1月20日,DeepSeek正式发布新一代推理模型DeepSeek-R1,并同步开源模型权重。该模型在数学、代码、自然语言推理等任务上性能卓越,其中在数学基准测试上的表现与OpenAI的o1模型正式版不相上下,引发业界广泛关注。
DeepSeek-R1采用强化学习训练,推理过程中能够生成大量反思和验证步骤,显著提升复杂问题的解决能力。目前,模型已上线官方API平台,开发者可通过接入获取服务,同时用户也可在网页端免费体验。
据悉,DeepSeek团队在研发中探索了多种训练策略,并验证了将长链推理能力蒸馏至小型模型的有效性。此次开源举措有望推动推理模型在垂直行业的应用落地,为AI生态注入新的活力。
咨询
咨询