36氪获悉,DeepSeek于近日在API平台正式上线了全新多模态模型DeepSeek-V4-Flash-Vision-Exp。该模型在纯文本能力(包括Agent、推理、世界知识等)方面与DeepSeek-V4-Flash正式版持平,但在视觉理解相关的Agent基准测试中实现了大幅跃升,多模态Agent能力已接近业界领先的Opus-4.8。

此次发布的模型标志着DeepSeek在多模态领域迈出重要一步,其视觉理解能力的提升将有助于拓展AI在图像识别、智能交互等场景的应用。目前,该模型已在DeepSeek API平台开放使用,开发者可集成调用。