来客网

DeepSeek视觉模型连夜实测

声明:本文转载自 「Popyard」, 或因排版与篇幅原因进行过编辑,内容未经本站独立核实,不代表本站立场、观点或建议。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]
01

家人们,鲸鱼开眼了!

等了四个月,DeepSeek的多模态模型:deepseek-v4-flash-vision-exp,终于发布。

我也是第一时间赶到现场,连夜开始实测。

相比V4 Flash最大的不同,就是支持原生支持图片输入了,但图片生成当然还是没有的。

基础识图能力实测下来,和一直在内测的网页版差不多,感觉就是同一个模型。

但在Agent任务上,「眼睛」确实可谓是超强的装备了。

先看,纯文本能力(Agent、推理、世界知识等),DeepSeek-V4-Flash-Vision-Exp与DeepSeek-V4-Flash正式版持平。

但值得注意的是,在需要多模态的Agent Benchmark上,这个新视觉模型相比V4-Flash,实现了大幅跃升!

甚至已接近Opus-4.8。

0

评论 (0)