GPT-6推理提速50%,OpenAI八九成研究已押向GPT-7和GPT-8

nashnova research
今天发布阅读约 4 分钟

OpenAI將GPT-6默認推理速度由30 TPS提升至50 TPS,但公司80%–90%研究資源已投向GPT-7和GPT-8——提速屬短期修補,下一代模型才是真正的賭注。

01

提速50%,用戶真的感受到嗎?

GPT-6 Astra和Sol每秒生成Token數由30升至50,覆蓋ChatGPT全線登入產品及OpenCode、Devin等第三方生態。
底層分詞器同步更換,完成同等任務所需Token總量被壓縮——這意味著→ 不只是「吐字更快」,而是同樣的工作,用更少Token就能完成。
不過部分開發者實測反映體感提升有限,須經API通道方能穩定達到50 TPS。簡單來說= 官方數字亮眼,實際體驗因使用方式而異。
02

八九成資源押向下一代,GPT-6算甚麼?

應用研究負責人鮑里斯·鮑爾(Boris Power)披露:80%–90%研究資源已聚焦GPT-7、GPT-8及更遠代際。
GPT-6的持續優化在內部甚至被部分視為「極度短視」的短期投入。這意味著→ OpenAI判斷,下一代模型上線後,當前許多痛點會自然消解,今日修補價值有限。
這反映出更深層的邏輯:OpenAI寧可讓現有產品「夠用就好」,把真正的工程力量留給代際躍遷。
03

「先做強、再蒸餾」——大模型和小模型甚麼關係?

OpenAI的產品路線:先訓練能力最強的大模型,再將其當「教師」,透過蒸餾(distillation)把能力遷移至更小、更便宜的模型。
實際案例:以GPT-4o蒸餾GPT-4o mini,特定任務準確率由64.67%拉升至79.33%,逼近GPT-4o本身的79.67%。
簡單來說= 你日常用的低價模型,背後其實有一個頂級模型在「手把手教」——小模型便宜,能力卻源自大模型的研究成果。
04

同樣花200美元,Claude值多少、ChatGPT值多少?

SemiAnalysis實測:月費200美元檔位,ChatGPT Pro等效API價值約2,084美元,Claude Max 20x約11,726美元——差距超過5倍。
各檔位差距一致:200美元檔Claude約為ChatGPT的5.6倍,100美元檔約5.4倍,20美元檔約5.6倍。
這意味著→ 在編程和Agent重負載場景下,Claude高價訂閱實際可用量遠超ChatGPT同價位產品。
05

訂閱背後的盈虧賬:誰在蝕錢?

Claude Pro和Max 5x用戶實際用量達到約20%時Anthropic才能盈虧平衡;而ChatGPT Plus和Pro 5x利用率一旦超過約11.4%即開始蝕錢。
OpenAI上週已將200美元ChatGPT Pro頂級套餐實際調用額度削減約一半,SemiAnalysis認為這與盈虧壓力直接相關。
說白了= OpenAI的重度用戶愈多,虧得愈狠——砍額度不是慳家,是止血。GPT-6提速能否縮小與Claude的價值差距,以及GPT-7、GPT-8能否兌現代際躍升,將是下一階段競爭力的核心檢驗。

市场有风险,内容仅供研究参考,不构成投资建议。

GPT-6推理提速50%,OpenAI八九成研究已押向GPT-7和GPT-8 · nashnova