2025年,DeepSeek凭借极低的训练成本与匹敌顶尖巨头的模型效果,在全球AI圈引发震动。在近期流出的长达3小时的内部交流中,创始人梁文锋详细拆解了DeepSeek的底层逻辑。面对Sora爆火后全行业追逐视频生成、世界模型的热潮,梁文锋选择“逆势而行”,明确表示这些方向虽商业价值高,但与智能上限无关。DeepSeek坚持聚焦AGI主线,将多模态视为工具组件而非技术进化的核心,力求在资源有限的情况下集中火力攻克真正的技术高地。

梁文锋规划了一条阶梯式的演进路线:从语言模型到思维链,再到Agent,随后必须攻克“持续学习”这一关键节点,最终迈向自我迭代的奇点与具身智能。他指出,当前AI最大的短板在于缺乏像人类员工那样的持续学习能力,每次处理新任务都需重置上下文。尽管目前全球尚未找到完美的解决方案,DeepSeek仍将其视为通往AGI的必经之路,并试图通过独特的组织文化来寻找突破口。

在算力资源上,DeepSeek面临着与美国巨头数量级的差距。梁文锋坦言,国内在激活参数规模上仍落后一个数量级,但他提出了以效率换时间的策略。DeepSeek通过自研TileLang编译器绕过CUDA生态,押注国产算力替代,目标是用二十分之一的算力将时间差从12-18个月缩短至3-6个月。同时,公司鼓励员工利用一半工作时间自由探索,试图在组织层面激发解决“持续学习”难题的灵感。

商业战略上,梁文锋推崇极致的“克制”。不同于OpenAI从非营利走向全面商业化的路径,DeepSeek坚持API定价只求十个月收回硬件成本,并承诺最强模型完全开源。他认为,在AI体量巨大的未来,独占者终将被历史抛弃,唯有通过低价和开源换取生态与人才凝聚力,才能在激烈的竞争中存活。这种“不追求暴利”的策略,旨在让中小公司用得起,从而构建更广泛的护城河。

然而,这种理想主义也面临着现实的考验。梁文锋将“团队稳定性”视为唯一不能退让的核心利益,通过可观的期权激励留住人才。但“克制商业化”与“高估值回报”之间存在天然的张力,若未来资本市场要求更高回报,现有的平衡能否维持仍是未知数。尽管如此,DeepSeek这种回归技术本质、在战略上极度聚焦且商业上保持清醒的探索,为中国AI行业提供了一条独特的突围范式。

本篇内容整理自网络,同步发布在 AEX新讯社中文网、希鸥网、斯贝瑞品牌资讯、RCEO创新网、AI联播网、创新日报 等媒体平台。如需删改或发布内容,请联系微信:meisceo29