DeepSeek V4.1 Flash开启内测,速度最高达507 tokens/s
nashnova research
9月8日DeepSeek开放V4.1 Flash内测,开发者实测输出速度最高达507 tokens/s,采用新模型结构、原生支持多模态,内测定价与V4 Flash持平,限时两天自动下线。
这个模型到底快了多少?
社交平台X上已有开发者实测,最高输出速度达507 tokens/s。
多位开发者用同一测试任务(SVG绘制鹈鹕骑自行车动画)跑分,记录到300至328 tokens/s。
这意味着→ 即使不取极端值,稳定区间已比大多数主流模型的推理速度快出一个数量级,"够快"已不是问题,稳定性才是。
新在哪里、怎么调用?
V4.1 Flash采用新模型结构,原生支持多模态(文字、图像等多种输入一套模型处理)。
开发者调用方式极简:保持base_url不变,模型名改为`deepseek-v4.1-flash-expires-on-0910`即可,每账号限20并发。
用大白话说= 不用换接口,只改一个字段就能试——但模型名自带到期日,9月10日自动下线,窗口只有两天。
价格有没有变?
内测定价与V4 Flash完全相同:空闲时段输入(缓存命中)0.05元/百万tokens,输入(缓存未命中)1.5元,输出4.5元。
高峰时段价格翻倍:输入分别为0.1元和3元,输出9元。
这意味着→ DeepSeek暂时没有因为速度提升而加价,能力升级、价格不动——但这只是内测阶段的定价,正式版是否维持尚不确定。
这轮更新节奏说明什么?
DeepSeek近两个月密集迭代:7月31日V4 Flash上线,8月13日V4 Pro上线,8月21日V4 Flash Vision Exp上线并于8月31日开源。
V4.1 Flash内测紧随其后,间隔不到两周。
这反映出 DeepSeek正处于高频发版周期,模型代际更替在加速——但内测阶段的速度表现能否在正式版中延续,仍需等实际上线后验证。
市场有风险,内容仅供研究参考,不构成投资建议。