中国人工智能(AI)企业深度求索(DeepSeek)推出一款能够理解视觉提示的实验性AI模型,称该工具的性能逼近美国竞争对手Anthropic PBC的一款高阶模型。

综合彭博社和华尔街见闻报道,总部位于杭州的DeepSeek星期五(8月21日)上线实验性视觉理解模型V4-Flash-Vision-Exp,新增图像理解能力并保持原有文本性能。

DeepSeek在X平台写道:“这款实验性多模态模型在文本能力方面与DeepSeek-V4-Flash相当 ,包括智能体(agent)、推理和世界知识。”

DeepSeek续称,在多模态智能体能力测试中,该模型的表现“接近”Anthropic的高阶模型Opus 4.8。

多模态智能体能力是指模型无需持续监督或提示即可采取行动。

延伸阅读

美研究机构:DeepSeek最新模型成本远低于其他模型
美研究机构:DeepSeek最新模型成本远低于其他模型
DeepSeek发布V4 Pro正式版 多项测试水平逼近Fable 5
DeepSeek发布V4 Pro正式版 多项测试水平逼近Fable 5

DeepSeek此前曾发布DeepSeek-VL系列等多模态和视觉模型。但这款名为DeepSeek-V4-Flash-Vision-Exp的新模型为DeepSeek最先进的模型系列,增加了图像理解和执行任务能力。用户可以通过DeepSeek的应用编程接口(API)使用该模型。

在API计费方面,V4-Flash-Vision-Exp沿用V4-Flash的定价。图片输入将转换为token计费,单张图片最多占用384个token。

DeepSeek上周发布新模型V4 Pro正式版,该版本的多项智能体能力大幅提升,据指性能已逼近Anthropic的前沿模型Claude Fable 5

中国企业与美国开发商正在AI前沿领域展开激烈竞争,中国模型往往能以低得多的价格提供相近的性能。