DeepSeek 开源了首个 V4 视觉模型,把 V4 体系从文本进一步扩展到图像理解与多模态处理,面向需要看图、读图和视觉问答的开发者与应用团队。此次更新让开发者可以直接调用这套开源视觉模型,搭建识别、检索、图文交互等能力,也补上了 DeepSeek 在视觉方向上的一块空缺。DeepSeek 同时公布了部分基准成绩,但相关表现仍需要第三方独立复核。随着 V4 视觉模型上线,开源阵营的多模态竞争又多了一个新选项。据Tech Times报道。
来源:Tech Times
原始发布时间:2026年9月1日 21:10