DeepSeek V4.1 Flash開啟內測,速度最高達507 tokens/s
nashnova research
9月8日DeepSeek開放V4.1 Flash內測,開發者實測輸出速度最高達507 tokens/s,採用新模型結構、原生支援多模態,內測定價與V4 Flash持平,限時兩天自動下線。
這個模型到底快了多少?
社交平台X上已有開發者實測,最高輸出速度達507 tokens/s。
多位開發者以同一測試任務(SVG繪製鵜鶘騎單車動畫)跑分,錄得300至328 tokens/s。
這意味著→ 即使撇除極端值,穩定區間已比大多數主流模型的推理速度快出一個數量級,「夠快」已非問題,穩定性才是關鍵。
新在哪裡、怎麼調用?
V4.1 Flash採用新模型結構,原生支援多模態(文字、圖像等多種輸入由一套模型處理)。
開發者調用方式極簡:保持base_url不變,將模型名改為`deepseek-v4.1-flash-expires-on-0910`即可,每帳號限20並發。
簡單來說= 毋須換接口,只改一個字段便可試用——但模型名自帶到期日,9月10日自動下線,窗口僅得兩天。
價格有沒有變?
內測定價與V4 Flash完全相同:空閒時段輸入(緩存命中)0.05元/百萬tokens,輸入(緩存未命中)1.5元,輸出4.5元。
高峰時段價格翻倍:輸入分別為0.1元和3元,輸出9元。
這意味著→ DeepSeek暫時沒有因速度提升而加價,能力升級、價格不動——但這只是內測階段定價,正式版能否維持仍屬未知。
這輪更新節奏說明甚麼?
DeepSeek近兩個月密集迭代:7月31日V4 Flash上線,8月13日V4 Pro上線,8月21日V4 Flash Vision Exp上線並於8月31日開源。
V4.1 Flash內測緊隨其後,間隔不足兩周。
這反映出 DeepSeek正處於高頻發版周期,模型代際更替在加速——而內測階段的速度表現能否在正式版中延續,仍待實際上線後驗證。
市场有风险,内容仅供研究参考,不构成投资建议。