DeepSeek发布实验性多模态模型,对标Anthropic Opus 4.8
DeepSeek发布了一款能够理解视觉提示的实验性AI模型,并称该工具在性能上已接近美国竞争对手Anthropic PBC的先进模型。
这家总部位于杭州的公司周五表示,此次发布的是一款实验版本,基于其主打的纯文本模型DeepSeek V4 Flash,并新增了多模态能力,这意味着它也能分析并响应图像、截图等视觉输入。
“这款实验性多模态模型在文本处理能力方面与DeepSeek‑V4‑Flash相当,包括智能体、推理以及世界知识等。”公司在X平台上写道。
该公司还表示,在测试多模态智能体能力时,该模型的表现“接近”Anthropic PBC的高级模型Opus 4.8。所谓多模态智能体能力,是指模型能够在无需持续监督或频繁指令的情况下自主采取行动。
更多阅读:美国在AI领域对华领先优势正迅速缩小
此前,DeepSeek也曾推出过多模态及视觉模型,例如DeepSeek‑VL系列。而此次推出的名为DeepSeek‑V4‑Flash‑Vision‑Exp的新产品,则在其最前沿的模型系列基础上进一步增强了图像理解与任务执行能力。
用户可通过DeepSeek的API调用该模型。
中国企业在AI前沿领域与美国开发者展开了激烈竞争,双方的模型往往在性能相近的情况下售价仅为后者的一小部分。DeepSeek旗舰模型今年早些时候的问世,更是重新定义了人们对低成本、开源权重模型所能达到的水平的预期。
评论
?
参与讨论