9月8日,DeepSeek宣布,DeepSeek V4.1 Flash的中间版本开启内测。该模型采用了新模型结构,原生支持多模态、能力更强、速度更快且成本更低。
开发者保持base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用,当前计费与DeepSeek V4 Flash相同,每账号限流20并发。

根据模型名称,此次内测9月10日会自动过期下线。
社交平台X上已经有一些开发者晒出了自己的体验,其中最高的输出速度达到507 tokens/s。

一位开发者让模型创建HTML,内容是SVG绘制一个鹈鹕骑自行车的2D动画,DeepSeek V4.1Flash输出速度达328 tokens/s。

另一位开发者也体验了鹈鹕骑自行车的测试,下图就是生成的效果,他透露输出的平均速度超过300 tokens/s。另一位网友称,手动添加该模型后发现,速度非常非常快。

DeepSeek系列模型近段时间更新频繁。
7月31日,DeepSeek V4 Flash正式版API率先上线公测;8月13日,DeepSeek V4 Pro正式版API发布;同日,DeepSeek Harness的开发者预览版(v0.1版本)正式公测,并同步开源。8月19日,DeepSeek Harness迭代至v0.1.0-rc.8版本。
紧接着,8月21日,DeepSeek V4 Flash Vision Exp上线DeepSeek API平台,并于8月31日正式开源。
如今,DeepSeek V4.1 Flash开启内测,或意味着其将开启新一轮的模型更新周期。




