DeepSeek发布多模态新模型,智能体性能接近Opus-4.8
Nashnova编辑部
DeepSeek上线多模态新模型V4-Flash-Vision-Exp,智能体基准测试性能接近Opus-4.8,标志其视觉理解能力完成一次显著迭代。
这个新模型到底是什么?
DeepSeek在API平台正式上线DeepSeek-V4-Flash-Vision-Exp——一个在原有V4-Flash基础上新增视觉能力的多模态模型(能同时处理文字和图像的AI模型)。
文本能力方面,它与V4-Flash持平,覆盖智能体、推理及世界知识三大核心领域。
这意味着→ 新模型不是"文本换视觉"的取舍,而是在保住文本底线的前提下叠加了图像理解。
智能体性能为什么值得关注?
在多模态智能体基准测试中,V4-Flash-Vision-Exp相较V4-Flash实现重大跃升,性能接近Opus-4.8。
用大白话说= Opus-4.8是当前顶级多模态模型之一;DeepSeek用一个"Flash"级别的模型就逼近了这个水平,性价比信号很强。
这反映出DeepSeek在视觉理解与智能体协同能力上的迭代速度,正在缩小与头部闭源模型的差距。
对行业意味着什么?
DeepSeek此前以低成本、高效率的开源路线著称;这次多模态升级延续了同一逻辑——用更轻量的架构逼近重量级对手。
这意味着→ 多模态AI的竞争门槛可能进一步降低,依赖视觉理解能力构建壁垒的厂商面临更大压力。
目前该模型标注为"Exp"(实验版),正式版的性能和定价仍待观察。
Content is for reference only, not financial advice.