当前位置: 首页 > news >正文

DeepSeek发布第二代MoE模型V2

在刚发布的最新模型因低成本引发大模型斩杀线的讨论后,DeepSeek反手宣布要涨价了。

8月6日,DeepSeek在开发者平台发布通知,计划近期整体上调其 API服务的定价,预计涨幅较大,具体方案以正式通知为准。随后,DeepSeek用户陆续收到了涨价邮件。

涨价似乎成为了今年国内大模型行业的主旋律。此前,智谱、月之暗面等都对老模型或新发模型进行了提价,主要云厂商也纷纷上调AI算力服务价格。

大模型价格战终于要走到尽头了吗?

从价格屠夫、斩杀线到突然涨价

搜狐科技了解到,在DeepSeek官宣涨价后,不少用户都陆续收到了DeepSeek团队发出的相关邮件。

邮件中除了提到DeepSeek API价格将有较大涨幅外,还提醒用户合理使用,并对涨价后的用户服务做出安排。“如您在计费调整后继续选择使用我们的服务,则代表您已同意调整后的计费方式;如不同意接受则可选择退出使用并申请退费。”

突然的涨价预告,让不少开发者措手不及。要知道,自DeepSeek出现在公众视野,其显著标签就是低价,基本发布的每款模型价格都远低于国内外多数大模型。

两年前,DeepSeek发布第二代MoE模型V2,API定价为输入1元、输出2元(单位均为1M Token),仅为当时最先进模型GPT-4-Turbo的百分之一,是当时已发布模型的最低价。

DeepSeek由此打响“价格屠夫”的名号,且从最初就坚持开源,这也让其在开发者群体里获得了“源神”的美誉。

随后DeepSeek发布的模型基本每次都没让人失望,无论是性能还是价格,尤其是R1创造的DeepSeek时刻更让这家公司彻底出圈,成为全球大模型行业备受瞩目的性价比之王。

DeepSeek自2024年以来发布的主要模型价格(单位:元/1M Token)

从DeepSeek自身来看,虽然模型性能在持续提升,但其API价格保持快速下降,输入价格已从1元降到最新的0.02元,输出价格也从此前高点16元降到2元。

一周前,DeepSeek正式上线的V4-Flash-0731创下其有史以来的模型最低价,这也在全球引发了大模型斩杀线的讨论。

对比来看,DeepSeek-V4-Flash-0731的价格显著低于Kimi K3、Qwen3.8-Max、GLM-5.2、GPT-5.6、Claude Opus 5和Fable 5等国内外头部模型,同时性能差距也不是很明显。

据独立研究公司Artificial Analysis,DeepSeek-V4-Flash-0731综合性能与GPT-5.6-Luna、Genimi-3.6 Flash并列,落后于国产模型Kimi K3、Qwen3.8-Max和GLM-5.2,以及OpenAI和Claude最新模型。

但是,DeepSeek-V4-Flash-0731是全球知名模型中运行成本最低的模型。从完成同等任务的花费来看,该模型平均成本为0.03美元,不到Kimi K3的4%,更不到Claude Fable 5的1%。

因此,此番DeepSeek罕见宣布涨价,则在开发者群体中炸开了锅,不少人呼吁不要涨太多。

开发者群体还玩起梗来,梁文锋的风评如同一只滑动变阻器,在“梁圣”、“梁叔”、“梁子”、“牢梁”之间演变,如今一夜之间则从“梁圣”变为“梁子”,以此来表达连“价格屠夫”也不得不向成本低头的感慨。

多位开发者认为,DeepSeek此次涨价并非是为了在模型火爆之际赚更多的钱,而是调用量的迅速攀升导致算力紧张,“梁老板说这钱我这不想挣,人家逼着我挣”。

其实DeepSeek此前发布V4预览版时,就有提到过,受限于高端算力,Pro的服务吞吐十分有限,预计下半年950超节点批量上市后,Pro价格会大幅下调。

业内认为,此次DeepSeek官宣涨价也意味着,V4-Pro正式版即将迎来上线。只不过,还未等到新的算力补充,DeepSeek就先迎来需求高峰。

为此DeepSeek此前实行了峰谷定价机制,高峰期调用价格翻倍,希望以此引导流量错峰,降低服务器压力。但有开发者对此吐槽称,现在DeepSeek就没有峰谷的问题,因为时差都是峰,国外那边用得也挺多。

海外开发者平台OpenCode披露,DeepSeek-V4-Flash单日处理量曾达8万亿Token,而模型聚合平台OpenRouter上400多款模型的日均总调用量才6.6万亿。

OpenCode高管透漏,其平台用户每天在DeepSeek模型上花费13万美元,请求过多导致API服务总是宕机,流量也因此遭到限制。

OpenRouter最新周榜显示,DeepSeek-V4-Flash在上周以7.22万亿Token的调用量首次登顶全球第一,本周目前仍以5.71万亿Token的调用量蝉联第一,且前五依然都是中国模型。

这些调用量不仅来自国内用户,海外用户也有贡献,越来越多的企业转向成本更低的中国开源模型。有美国AI创业公司创始人就表示,已切换到DeepSeek V4,这将在未来几个月能给公司省下数百万美元。

从“价格屠夫”到大模型斩杀线,再到突然宣布涨价,这并不是梁文锋要加速商业化变现的主动选择,而更多像是应对需求爆发而导致算力紧张的应对之举。

业内分析称,DeepSeek通过涨价希望对目前有限的算力进行再分配。对以技术优先的DeepSeek来说,留出更多算力训练更前沿的模型可能更重要,尤其是在对手们仍在持续进步的情况下。

梁文锋此前在投资交流中也多次强调要克制,不追求营收和利润最大化,API定价的逻辑是十个月收回设备成本,赚取合理的利润,要让大家用得起。

不少开发者判断,虽然DeepSeek预计涨幅较大,但最终价格可能仍会低于国内其它头部模型。

大模型终于告别价格战?

DeepSeek不是第一家宣布涨价的大模型公司。

今年2月,智谱推出新一代旗舰模型GLM-5,Coding Plan套餐价格涨幅30%起,随后发布的GLM-5-Turbo、GLM-5.1分别提价20%、10%,GLM-5.2综合定价则又比前一代高出13%。

智谱7月底又更新订阅紧张的GLM Coding Plan国内版套餐,Lite/Pro/Max套餐分别从40/149/469元涨至118/538/1078元,最低涨幅130%,最高则达超260%

此前,智谱CEO张鹏表示,今年一季度API涨价83%,但调用量不降反升400%,市场仍供不应求。这一定程度成为智谱涨价的底气,但持续上涨的算力成本依旧是涨价的关键驱动因素。

此前引发关注的Kimi K3的API价格同样迎来上涨,100元/1M Token的输出价格相较上代模型K2.7增长2.7倍,是目前国内定价最高的模型。

这一定程度是中国大模型试图剥离低价标签、通过智能水平掌握模型定价权的尝试,但背后都有着算力不够的苦涩。Kimi K3爆火后遭遇算力挑战,不得不暂停订阅,并进行算力扩容。

今年以来,阿里云、百度云、腾讯云等主要云厂商都对AI算力、存储等产品进行最低5%到超过30%不等的涨价。

从全球来看,大模型和云厂商涨价也是趋势。杰富瑞统计,今年二季度美国大模型API价格上涨了89%,典型如Claude Fable 5的价格相较上代模型翻倍。

不过,也有少数厂商在降价。今年5月底,小米MiMo宣布MiMo-V2.5系列API永久降价,新定价最高降幅达99%。这更多是后来者为追赶而采取的措施,该模型调用量随后迅速爆发。

最新宣布降价的则是OpenAI。上月底,OpenAI下调GPT 5.6系列两款新发布模型的价格,其中GPT-5.6 Luna下调80%,GPT-5.6 Terra下调 20%。仅过一周,OpenAI最新又宣布将ChatGPT免费用户的默认模型更新为GPT5.6 Luna。

业内普遍认为,这是OpenAI为应对外有中国开源模型来袭、内有劲敌Anthropic竞争而采取的应对举措。前者正在吸引越来越多的美国企业和开发者,而后者凭借更为强大的模型能力在企业端持续爆发。

两年前,DeepSeek闯入大模型赛道伊始就开启了轰轰烈烈的价格战,如今它自己按下了暂停键。随着需求爆发和定价提高,中国头部大模型公司商业化能力有望迎来重新定价。

高盛最近就将中国大模型厂商今年底的合计ARR(年度经常性收入)从100亿美元上调至130亿美元,并预测2030年将攀升至1250亿美元,实现五年25倍的增长。

但高盛也表示,今年行业训练总成本40亿美元、推理总成本70亿美元,合计将高于当期ARR,板块整体仍处于负EBIT状态,盈利拐点要到2030年才会出现。

不过,从长远看,DeepSeek可能依旧是一个变量。

梁文锋此前表示,在当前价格区间,用户需求没有太大弹性,继续降价并不会带来更多需求,价格翻倍也不会导致需求明显下降。但他也强调,未来包括模型优化等在内的整体降价空间还是比较大。

公开报道显示,DeepSeek年化收入已逼近5亿美元,V4旗舰API毛利率约70%-80%,远高于字节、智谱、MiniMax等公司的MaaS业务,反映出DeepSeek强悍的成本优化控制能力。

在此次涨价后,DeepSeek未来在算力解决后有没有可能再降价,仍存变数。毕竟,在目前的高毛利支撑下,其相较行业对手仍有下降空间。

目前,DeepSeek依然在广积粮,此前已完成首轮500亿元融资。虽然主要输血来源幻方因市场调整今年收益不佳,但最新报道称,其已开启寻求近80亿美元的第二轮融资。

这些资金中的部分计划用于采购算力资源,并推进大型数据中心建设,加强基础设施投入。算力,同样是月之暗面、智谱、MiniMax持续融资中的投入重点。

一面是越来越多的用户需求,一面是没有尽头的技术竞赛,大模型玩家们都需要权衡先后利弊,短期长期。暂时停下的风暴,未来也可能重来。

http://www.cnnetsun.cn/news/3924032.html

相关文章:

  • InnoDB存储引擎架构与性能优化实战
  • 中介者模式:解耦复杂系统的星型通信方案
  • UE5汽车蓝图项目:高效文件夹结构与可视化工程管理实践
  • 网工毕业设计易上手选题集合
  • 多尺度计算方法:跨尺度科学计算的核心技术与应用
  • AI写作工具如何提升研究生论文效率与质量
  • 行业积累:银行知识-会计基础概念
  • 【当AI替你回答了用户的问题:企业内容建设如何应对“跳过官网“时代】
  • ITIL 4迁移中的三大隐形陷阱与应对策略
  • 厘米波探测与制导技术在现代电子战中的应用
  • 深度解析甘肃省建设厅官方网站:获取权威政策、工程审批与建筑资质的关键指南
  • Java Jackson循环引用问题解决方案与性能优化
  • 数字孪生IOC架构演进:从可视化监控到智能决策支持
  • AI知识蒸馏技术原理、局限与实战选择:从模型压缩到原始创新
  • 企业官网GEO优化技术指南:让AI搜索引擎抓取并引用你的内容
  • UE5第三方库插件化集成:跨平台配置与动态库管理实战
  • 技术人如何提升执行效率与问题定位能力:从环境优化到排查框架
  • 午夜心事:当AI替代人类,全球青少年为何向聊天机器人倾诉?
  • Java并发编程与Stream流操作高频面试题解析
  • QClaw实战:30天用自动化规则引擎打造健身习惯,瘦8斤背后的技术原理
  • 桶装水排队返利模式系统开发
  • 焦作网站建设jz518揭秘:传统企业如何借数字化东风实现品牌腾飞与业绩倍增
  • MYSQL 事务原理
  • Plotly交互式数据可视化实战指南
  • 拒绝盲目开工!深度解析网站建设进度安排中的关键节点与避坑指南,助您高效落地
  • AI代码生成从功能实现到工程质量的提升策略与实践
  • 重新注册VS商标设计注册驳回复审要花多少钱?
  • 《我的世界》服务器生存开局指南:高效逃离出生点与选址建家
  • AI Agent长任务运行时架构:状态持久化、Judge闭环与自主续航解析
  • MySQL硬扛百万向量搜索:LSH索引实战与RAG技术选型思考