帮帮团

主页
帮帮团网站

DeepSeek视觉理解模型性能逼近Opus 4.8

更新时间:2026-08-22 12:12:16点击:

深度求索(DeepSeek)推出一款能够理解视觉提示的实验性AI模型,该工具的性能逼近美国竞争对手Anthropic PBC的一款高阶模型。

总部位于杭州的DeepSeek星期五(8月21日)上线实验性视觉理解模型V4-Flash-Vision-Exp,新增图像理解能力并保持原有文本性能。

DeepSeek在X平台写道:“这款实验性多模态模型在文本能力方面与DeepSeek-V4-Flash相当 ,包括智能体(agent)、推理和世界知识。”

在多模态智能体能力测试中,该模型的表现“接近”Anthropic的高阶模型Opus 4.8。

多模态智能体能力是指模型无需持续监督或提示即可采取行动。

DeepSeek此前曾发布DeepSeek-VL系列等多模态和视觉模型。但这款名为DeepSeek-V4-Flash-Vision-Exp的新模型为DeepSeek最先进的模型系列,增加了图像理解和执行任务能力。用户可以通过DeepSeek的应用编程接口(API)使用该模型。

在API计费方面,V4-Flash-Vision-Exp沿用V4-Flash的定价。图片输入将转换为token计费,单张图片最多占用384个token。

DeepSeek上周发布新模型V4 Pro正式版,该版本的多项智能体能力大幅提升,据指性能已逼近Anthropic的前沿模型Claude Fable 5。



专题:DeepSeek视觉理解模型

热门文章

17750209359
17750209359
已为您复制好微信号,点击进入微信