DeepSeek视觉理解模型性能逼近Opus 4.8
中国人工智能(AI)企业深度求索(DeepSeek)推出一款能够理解视觉提示的实验性AI模型,称该工具的性能逼近美国竞争对手Anthropic PBC的一款高阶模型。
综合彭博社和华尔街见闻报道,总部位于杭州的深度求索星期五(8月21日)上线实验性视觉理解模型V4-Flash-Vision-Exp,新增图像理解能力并保持原有文本性能。
深度求索在X平台写道:“这款实验性多模态模型在文本能力方面与DeepSeek-V4-Flash相当 ,包括智能体(agent)、推理和世界知识。”
深度求索续称,在多模态智能体能力测试中,该模型的表现“接近”Anthropic的高阶模型Opus 4.8。
多模态智能体能力是指模型无需持续监督或提示即可采取行动。
延伸阅读
美研究机构:DeepSeek最新模型成本远低于其他模型深度求索此前曾发布DeepSeek-VL系列等多模态和视觉模型。但这款名为DeepSeek-V4-Flash-Vision-Exp的新模型为深度求索最先进的模型系列,增加了图像理解和执行任务能力。用户可以通过DeepSeek的应用编程接口(API)使用该模型。
在API计费方面,V4-Flash-Vision-Exp沿用V4-Flash的定价。图片输入将转换为token计费,单张图片最多占用384个token。
深度求索上周发布新模型V4 Pro正式版,该版本的多项智能体能力大幅提升,据指性能已逼近Anthropic的前沿模型Claude Fable 5。
中国企业与美国开发商正在AI前沿领域展开激烈竞争,中国模型往往能以低得多的价格提供相近的性能。
深度求索中国人工智能中美科技战中美关系财经看点长江存储科创板上市申请获受理 拟募资330亿人民币购买此文章最新
热门
Loading...更多消息
订阅新闻速递,洞悉时代脉搏。
只想接收感兴趣的新闻速递? 点击设置您的偏好。
注册即表示我接受新报业媒体不时更新的使用条款及个人资料保护声明。
是, 我希望收到新报业媒体的市场宣传及营销信息。
评论 (0)