9月8日,DeepSeek V4.1 Flash的中间版本开启内测,采用新模型结构并原生支持多模态,主打更强能力、更快速度和更低成本,价格与V4 Flash持平。网友实测输出速度最高达507 tokens/s,或预示DeepSeek新一轮模型迭代周期开启。
9月8日,DeepSeek宣布,DeepSeek V4.1 Flash的中间版本开启内测。该模型采用了新模型结构,原生支持多模态、能力更强、速度更快且成本更低。
开发者保持base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用,当前计费与DeepSeek V4 Flash相同,每账号限流20并发。
与DeepSeek V4 Flash相同,DeepSeek V4.1 Flash当前内测版本的价格为空闲时段每百万tokens输入(缓存命中)0.05元,输入(缓存未命中)1.5元,输出4.5元;高峰时段对应价格为每百万tokens输入(缓存命中)0.1元,输入(缓存未命中)3元,输出9元。
0
评论 (0)