GPT-6推理提速50%,OpenAI八九成研究已押向GPT-7和GPT-8
nashnova research
OpenAI将GPT-6默认推理速度从30 TPS提升至50 TPS,但公司80%–90%的研究资源已投向GPT-7和GPT-8——提速是短期修补,下一代模型才是真正的赌注。
提速50%,用户真能感受到吗?
GPT-6 Astra和Sol的每秒生成Token数从30升至50,覆盖ChatGPT全线登录产品及OpenCode、Devin等第三方生态。
底层分词器同步更换,完成同等任务所需Token总量被压缩——这意味着→ 不只是"吐字更快",而是同样的活,用更少的Token就能干完。
不过部分开发者实测反映体感提升有限,需通过API通道才能稳定达到50 TPS。用大白话说= 官方数字好看,但实际体验因使用方式而异。
八九成资源押向下一代,GPT-6算什么?
应用研究负责人鲍里斯·鲍尔(Boris Power)披露:80%–90%的研究资源已聚焦GPT-7、GPT-8及更远代际。
GPT-6的持续优化在内部甚至被部分视为"极度短视"的短期投入。这意味着→ OpenAI判断,下一代模型上线后,当前许多痛点会自然消解,今天的修补价值有限。
这反映出一个更深的逻辑:OpenAI宁可让现有产品"够用就好",把真正的工程力量留给代际跃迁。
"先做强、再蒸馏"——大模型和小模型什么关系?
OpenAI的产品路线是:先训练能力最强的大模型,再把它当"教师",通过蒸馏(distillation)把能力迁移到更小、更便宜的模型上。
实际案例:用GPT-4o蒸馏GPT-4o mini,特定任务准确率从64.67%拉升到79.33%,逼近GPT-4o本身的79.67%。
用大白话说= 你日常用的低价模型,背后其实站着一个顶级模型在"手把手教"——小模型便宜,但能力来自大模型的研究成果。
同样花200美元,Claude值多少、ChatGPT值多少?
SemiAnalysis实测:月费200美元档位,ChatGPT Pro等效API价值约2084美元,Claude Max 20x约11726美元——差距超过5倍。
各档位差距一致:200美元档Claude约为ChatGPT的5.6倍,100美元档约5.4倍,20美元档约5.6倍。
这意味着→ 在编程和Agent重负载场景下,Claude的高价订阅实际可用量远超ChatGPT同价位产品。
订阅背后的盈亏账:谁在亏钱?
Claude Pro和Max 5x用户实际用量达到约20%时Anthropic才能盈亏平衡;而ChatGPT Plus和Pro 5x利用率一旦超过约11.4%即开始亏损。
OpenAI上周已将200美元的ChatGPT Pro顶级套餐实际调用额度削减约一半,SemiAnalysis认为这与盈亏压力直接相关。
用大白话说= OpenAI的重度用户越多,亏得越狠——砍额度不是抠门,是止血。GPT-6提速能否缩小与Claude的价值差距,以及GPT-7、GPT-8能否兑现代际跃升,将是下一阶段竞争力的核心检验。
市场有风险,内容仅供研究参考,不构成投资建议。
