出品 | 网易智能
作者 | 辰辰
编辑 | 王凤枝
上线仅三周,,,,价钱最高下调八成。。
OpenAI的GPT-5.6系列7月上旬才推出,,,,7月30日,,,,Luna模子就从每百万token输入1美元,,,,直接砸到20美分。。中档的Terra降20%。。旗舰Sol纹丝不动。。
CEO山姆·奥特曼(Sam Altman)在X上发帖:"今天宣布大幅降价。。"
官方诠释是:GPU内核、推理系统和生产情形效率均有所提升,,,,公司将效率提升带来的收益部分反馈给用户。。
听着很合理。。但Luna降80%,,,,Terra降20%,,,,Sol一分不降。。这个降价名堂,,,,单靠"效率提升"四个字诠释不了。。
一、烧钱时代竣事了
硅谷有一个词,,,,叫tokenmaxxing。。
意思是在使用AI时尽可能增添token消耗,,,,以最大化使用AI能力,,,,而不优先思量本钱。。这个词降生于2023年,,,,自己就带着自嘲。。彼时ChatGPT引爆全球,,,,美国企业争先恐后把AI塞进每一个事情流,,,,账单的事以后再说。。
现在,,,,账单来了。。
AI账单已经膨胀到数十亿美元规模。。CNBC的报道里有一个细节:亚马逊刚刚把2026年的资笔僻出上调到2200亿美元,,,,其中一大块烧给了AI基础设施。。企业端的AI开支同样在膨胀。。软件公司、金融机构、医疗集团,,,,每家每年花在AI API和智能体上的钱,,,,动辄数万万美元。。
《华尔街日报》6月份就披露过,,,,OpenAI在思量大幅降价,,,,而它预判竞争敌手Anthropic也会跟进。。企业高管最先不耐心了。。 Uber一位高管透露,,,,公司2026年的AI智能体预算已经用尽。。另一位科技公司认真人坦言:很难把AI编程带来的效率提升,,,,直接对应到新功效和新收入上。。
"tokenmaxxing的时代竣事了。。" 市场研究机构EMARKETER高级剖析师雅各布·博恩(Jacob Bourne)这样果真下了判断。。
企业不再照单全收。。他们在问统一个问题:花了几万万美元,,,,究竟换来了什么??????
CNBC有篇最新报道的问题耐人寻味:China's open-weight model lead exposes America's AI blind spot。。中国开源权重模子的领先,,,,袒露了美国AI的盲区。。这个盲区不是手艺,,,,是本钱。。
已往,,,,这个问题最多让AI公司有点尴尬。。现在纷歧样了。。中国公司带着另一种打法登场了。。
二、中国模子的另一种打法:开放权重
7月初,,,,中国首创公司月之暗面(Moonshot AI)宣布了开源权重模子Kimi K3。。在一些行业基准测试中,,,,它的体现凌驾了美国最先进的闭源系统。。
要害是:Kimi K3的模子权重是果真的。。 用户可以下载、修改,,,,并安排在自己的基础设施上,,,,不需要支付月之暗面的API挪用用度。。
它不是孤例。。DeepSeek、智谱(Z.ai)的GLM-5.2、阿里的Qwen系列。。一些中国公司正在通过开放权重、低价服务等方式提供前沿AI能力。。
《The Verge》在一篇深度剖析中直指焦点矛盾:"一家AI公司花了天量资金训练模子,,,,为什么要把最有价值的部分免费送出去??????"
福特汉姆大学法学教授钦玛伊·沙玛(Chinmayi Sharma)的谜底很透彻:"一组免费的权重,,,,不即是一个免费的AI服务。。公司可以在模子免费的同时,,,,从盘算基础设施、工程、清静、维护等环节赚钱。。"
当中国开源权重模子的性能追平闭源,,,,开发者最先在AWS、Azure甚至外地集群上私有化安排这些模子,,,,直接切走了OpenAI的API挪用量。。 对OpenAI来说,,,,丢掉的不但是一笔笔推理收入,,,,更是"默认选项"的职位。。一旦开发者习惯了开源安排的事情流,,,,就很难再拉回来。。
乔治城大学清静与新兴手艺中心高级研究员凯尔·米勒(Kyle Miller)以阿里Qwen系列模子为例,,,,指出它在中国工业界的渗透深度,,,,展现了开源生态一旦扎根的威力。。
美国这边,,,,围绕开源权重的政策辩说也起来了。。Kimi K3宣布后,,,,一个由25家科技公司组成的同盟(包括IBM、微软、Meta、英伟达、Palantir)揭晓果真信,,,,忠言美国政府不要对开源权重模子施加"过早的限制"。。这封信点名缺席的,,,,恰恰是OpenAI、谷歌和Anthropic三家闭源巨头。。
《The Verge》的报道问题写得直白:Why China is giving away its best AI models。。中国为什么要把最好的AI模子免费送人??????
对美国闭源模子提供商来说,,,,这不但是价钱竞争,,,,也涉及商业模式的挑战。。当中国公司把前沿模子免费开放,,,,OpenAI和Anthropic还能靠"按token计价"的模式撑多久??????
三、但涨价也在爆发
中国开源权重模子用免费撕开了一道口子。。但免费是一种打法,,,,不是所有中国公司都选了这条路。。
就在OpenAI宣布降价的统一天(7月30日),,,,中国AI公司智谱在海内不限量重新开放了GLM Coding Plan订阅服务,,,,价钱不是降了,,,,是涨了。。唬;蛘吒既返厮,,,,是跟国际版价钱对齐。。
Lite档从每月49元涨到118元,,,,涨幅140%;;;Pro档从149元涨到538元,,,,涨幅260%;;;Max档从469元涨到1078元,,,,涨幅130%。。
智谱今年已经涨过好一再。。2月,,,,GLM Coding Plan整体上调30%起步,,,,作废首购优惠。。3月,,,,GLM-5-Turbo API加价20%。。4月,,,,外洋版全线涨价80%到140%。。一季度累计下来,,,,智谱的API定价提升了83%。。
价钱上涨,,,,但用量增添更快。。400%。。
这是整个故事里最反直觉的一组数字:价钱涨了八成,,,,用量翻了四倍。。智谱CEO张鹏在业绩说明会上的诠释是:模子能力提升意味着推理链路更长,,,,一个重大使命的token消耗量可以抵达简朴问答的十倍甚至百倍。。涨价"是本钱转变的自然效果"。。
智谱的官方亮相更直白:低价竞争倒运于行业生长,,,,价钱需要"回归正常商业价值区间"。。摩根大通7月研报给出了投资端的注脚:GLM-5.2的平均API收费较上一代提高了约13%,,,,公司"展现出更强的定价能力"。。目的价上调到1800港元,,,,维持增持评级。。
这不但是智谱一家的事。。据律动BlockBeats统计,,,,2026年头以来,,,,中国已有七家云厂商和模子厂商上调价钱,,,,最高涨幅凌驾400%。。中国AI行业正在履历一个整体转身:从"免费津贴抢用户"转向"商业变现求生涯"。。
统一其中国市场,,,,正在上演两出完全相反的戏。。
需要分清两件事的计价工具。。Kimi K3免费的是模子权重,,,,你可以下载、可以安排,,,,但推理算力由你自己肩负,,,,一张H100的租金并没有消逝。。智谱涨价的是商业API服务,,,,厂商代你肩负了算力、运维和一连迭代本钱,,,,价钱里包括的是一整条"开箱即用"的生产链。。一个免费的是半制品质料,,,,一个涨价的是制品服务,,,,它们并不在统一条价钱轴上竞争。。
这两件事同时爆发,,,,并不矛盾。??????慈ㄖ啬W拥拿夥颜铰,,,,是为了建生态、抢标准;;;商业API服务的涨价战略,,,,是为了活下来、证实商业模式。。前者是战略性投入,,,,后者是生涯性选择。。
对OpenAI而言,,,,这形成了一种重大时势:中国开放权重模子正在低本钱市场形成竞争压力,,,,而部分商业API服务则探索更高价值定位。。OpenAI夹在中心:降价吧,,,,中国开源模子比你更自制;;;涨价吧,,,,智谱正在证实"贵一点也有人买单"。。
四、华尔街要看账本了
降价的在降价,,,,涨价的在涨价。。两件事凑到一起,,,,问的着实是统一件事:这个行业的商业模式,,,,究竟能不可跑通??????
OpenAI和Anthropic马上就要面临这个问题了。。由于它们都在准备上市。。
OpenAI已于本周向美国证券生意委员会神秘提交了IPO申请,,,,奥特曼在内部Slack新闻中说妄想"一年内上市"。。Anthropic也在走同样的路。。价钱竞争,,,,可能成为这两家公司上市前需要面临的一项商业模式磨练。。
Gartner优异副总裁剖析师阿伦·钱德拉塞卡兰(Arun Chandrasekaran)对Business Insider的判断很直白:"这次价钱竞争,,,,可能是前沿AI实验室商业模式的一次早期测试。。尤其是OpenAI最近神秘提交了IPO申请。。"
说究竟就是华尔街要看账本。。降价能不可换来足够大的使用量??????使用量能不可填补利润率的压缩??????这个故事,,,,投资人买不买账??????
不止OpenAI在焦虑,,,,整个赛道都在转向。。谷歌7月宣布了三款新模子,,,,主打的卖点就是比Kimi K3更自制。。微软CEO萨提亚·纳德拉(Satya Nadella)在季度财报电话会上,,,,重复把"本钱效率"挂在嘴边,,,,称其为微软MAI-Thinking-1模子的"焦点"。。Anthropic新推出的Claude Opus 5,,,,性能靠近旗舰Fable 5,,,,价钱只要一半。。
X上一位用户的谈论一针见血:"DeepSeek和Kimi K3突破的不但是OpenAI的能力护城河,,,,尚有它的定价地板。。降价80%不是立异,,,,是恐慌性打折。。"
但若是只看价钱跌幅就下结论,,,,可能忽略了调价背后的结构设计。。
五、OpenAI布的局:塔尖的才值钱
回到OpenAI自己。。降价背后,,,,它着实在布一个更深的局。。
细看这次调价:Luna降价80%,,,,Terra降价20%,,,,而Sol价钱坚持稳固。。这更像是一种分层定价战略,,,,而非周全降价。。
降价后,,,,Luna的输入价钱(20美分/百万token)已经低于DeepSeek V4 Pro(约43美分),,,,迫近Kimi K3的缓存掷中价。。OpenAI总裁格雷格·布罗克曼(Greg Brockman)在X上写道:"Luna现在显然是同级别中最具性价比的模子。。"
对开发者来说,,,,这个价钱意味着什么??????自力开发者WolfMark Tools在X上算了一笔账:GPT-5.6 Luna的编程能力,,,,已经靠近此前许多用户使用的GPT-5.5高品级版本。。而价钱,,,,只有后者的二十五分之一。。
"对大大都开发者来说,,,,问题不再是'我能肩负得起AI编程智能体吗',,,,而是'我为什么不找一个来用'。。"他写道。。
日本投资人国光宏尚以为,,,,Luna可能被OpenAI定位为AI智能体时代的基础运行模子。。足够智慧、足够自制,,,,可以7×24小时不中止运行。。日常使命跑Luna,,,,重大使命上Terra,,,,要害决议用Sol。。一套"低中高"三级火力设置,,,,第一次在价钱上有了实战意义。。
这套战略的潜台词是:OpenAI认可了低端市场的价钱战现实,,,,但它同时想证实,,,,真正值钱的工具,,,,在塔尖。。
公正地说,,,,OpenAI的效率提升并非全是话术。。用Sol来优化自家模子的推理代码,,,,让AI来降低AI的运行本钱,,,,这件事自己确着实爆发。。国光宏尚估算,,,,GPU内核调优和推理情形优化帮OpenAI降低了约20%的服务本钱。。
但20%的本钱节约,,,,诠释不了80%的降价。。剩下的缺口,,,,是中国开源模子用"免费"两个字生生撕开的。。
布罗克曼在宣布降价时,,,,说了一句意味深长的话:"期待看到你们用'自制到不值得计价'的智能做出什么工具。。"
"自制到不值得计价"(too cheap to meter)。。这个词脱胎于20世纪核电时代的著名口号:"电力会自制到不值得装电表。。"当一样工具自制到你不再盘算单次本钱时,,,,它的计价方式就彻底变了。。
六、AI正在履历的时刻
中国开放权重模子带来的影响,,,,不但是降低AI使用本钱,,,,也让行业重新思索按token销售智能的商业模式。。X上一位用户写道:"中国没有仅仅降低中国AI的价钱,,,,它迫使整个行业降低了智能的价钱。。"
但智谱的涨价提醒了另一件事:好的智能,,,,照旧有人愿意付钱的。。
当Kimi K3把前沿能力免费开放,,,,当DeepSeek用不到5美元跑完一个完整编程使命,,,,当智谱把Coding Plan从49块涨到118块、挪用量反而翻了四倍。。这三个事实摆在一起,,,,指向的是统一个结论:
智能的定价方式正在分化:一部分走向更开放、更低本钱,,,,另一部分则通过高价值服务维持更高价钱。。
一半免费。。一半更贵。。
OpenAI想同时站在这两半上。。这可能吗??????