01
家人们,鲸鱼开眼了!
等了四个月,DeepSeek的多模态模型:deepseek-v4-flash-vision-exp,终于发布。
我也是第一时间赶到现场,连夜开始实测。
相比V4 Flash最大的不同,就是支持原生支持图片输入了,但图片生成当然还是没有的。
基础识图能力实测下来,和一直在内测的网页版差不多,感觉就是同一个模型。
但在Agent任务上,「眼睛」确实可谓是超强的装备了。
先看,纯文本能力(Agent、推理、世界知识等),DeepSeek-V4-Flash-Vision-Exp与DeepSeek-V4-Flash正式版持平。
但值得注意的是,在需要多模态的Agent Benchmark上,这个新视觉模型相比V4-Flash,实现了大幅跃升!
甚至已接近Opus-4.8。
0
评论 (0)