首页 科技快讯 突发!DeepSeek V4正式版或延至8月中旬,国内大模型竞速生变

突发!DeepSeek V4正式版或延至8月中旬,国内大模型竞速生变

来源:晰数塔互联网快讯 时间:2026年07月29日 06:34

(来源:智能纪元AGI)

原本7月底发布的DeepSeek V4模型,似乎要推迟了。

智能纪元AGI 7月28日消息,据报道,DeepSeek 即将为自研 Harness 工具启动封闭测试,并从问卷参与者中挑选少量用户。封闭测试结束后约 1 至 2 周会开放 V4 GA,发布时间可能在 8 月 10 日至 20 日之间。

这意味着,DeepSeek V4 正式版(V4 GA)可能推迟到 8 月中旬发布。

如果消息属实,DeepSeek V4 正式版上线时可能会面对更强竞争。

届时 GPT-6、Claude Fable 5.1、GLM-5.5 等下一代模型可能已经进入市场,此外还有如今全局最强的2.8万亿参数的Kimi K3模型。

与此同时,据第一财经报道,DeepSeek已口头通知部分潜在投资者,未来几天暂停按原计划签署第二轮融资协议。相关融资谈判仍处于变化中,后续仍可能恢复,目前尚不清楚DeepSeek是否已向所有潜在投资者传达相同安排。

此前,DeepSeek第二轮融资计划拟募集至少100亿元人民币,目标投前估值超过4800亿元人民币。

显然,从模型到融资,DeepSeek已经摁下了“暂停键”。

先复盘一下DeepSeek过去两个月发生了什么。

2026年4月24日,DeepSeek-V4 Preview(预览版)正式发布,推出双模型V4-Pro(总参 1.6T MoE、激活 49B)、V4-Flash(总参 284B、激活 13B);全系原生支持100 万 token 超长上下文。

对于行业来说,比较关注DeepSeek-V4首发深度适配华为昇腾系列芯片,双架构技术,完成 CANN 底层算子改造,实现国产算力原生部署。

随后,4 月 26 日官方紧急开启 V4-Pro 限时 2.5 折优惠(原定截止 5 月 5 日,后续延期至 5 月 31 日)。5月22日,官宣5月31日限时折扣结束后,V4-Pro 定价锁定为原价1/4。

2026年6月16日,市场消息称,DeepSeek完成创立以来首轮外部融资,创下国内 AI 初创纪录,总募资约510 亿元人民币,投后估值接近 4000 亿元。

出资结构中,创始人梁文锋出资 200 亿(最大单一出资方);腾讯 100 亿;宁德时代体系 50 亿;京东、网易、IDG 各 30 亿。资金用途包括自建算力中心、推进 V4 正式版研发、国产算力适配、自研硬件项目。

6月29日,DeepSeek向全体 API 开发者推送重要邮件通知,不仅重新涨价,而且公布原定计划,DeepSeek V4 正式版(GA)7 月中旬上线。

一周之前的7月21日,行业有传闻,V4 正式版延期,知情人士透露目标调整至7月底前后。

7月26日,彭博报道:第二轮融资谈判临时暂停。

说完这些你知道的信息,再说点你不知道的信息。

DeepSeek-V4 Pro预览版的排名,已经跌倒了25位,甚至低于Kimi-K2.7 Code。

再看AA排名,Kimi K3已经是遥遥领先水平,即便GLM-5.2,也不落下风,DeepSeek-V4 Pro,已经排到了MiniMax M3下面。

更糟糕的是token消耗量和LLM排名,小米Mimo-2.5系列和免费的英伟达Nemotron 3模型也都遥遥领先。

怎么形容呢,现在梁文锋比较尴尬,而我们觉得杨植麟、姚顺雨还是要多加油。

毕竟,姚顺雨都已经一统混元部门了。

先说说几家国内大模型竞速模式。

Kimi:

7月28日凌晨,Kimi K3 正式开放模型权重。

全球第一个开源的3T量级、原生多模态 agentic 的模型,2.8 万亿参数,开源里断层第一,第二名 DeepSeek V4 Pro 是1.6T,GLM-5.2 参数量也才744B。

而V4 Pro 1.6万亿总参数、每token激活49亿,在往下压激活量;K3 2.78万亿总参数、每token激活1042亿,把激活量翻了一倍多。

现在Kimi已经超过DeepSeek,在硅谷AI圈热度极高。

混元:

上任第201天,姚顺雨的混元3正式转正。

7月6日下午,腾讯正式发布其基座模型混元Hy3,该版本是对4月23日发布并开源的混元Hy3 preview(预览版)的迭代,腾讯进一步提升了其后训练的算力规模,以及数据质量和多样性。

据悉,Hy3是一个快慢思考融合的模型,采用MoE架构,总参数295B、激活参数21B,支持 256K上下文长度,Hy3在各类任务上较预览版有所提升,重点强化了Agent(智能体)能力。

混元强调了一个数据:4月预览版上线以来,Hy3系列模型日均token(词元)消耗量增加了20倍。

即便到了今天,HY3的消耗量似乎远低于DeepSeek、Mimo等模型。

7月23日,腾讯宣布将混元大语言模型部与多模态模型部合并,组建“基础模型部”,由腾讯首席AI科学家姚顺雨统一负责。

合并后,姚顺雨的管辖范围从大语言模型和AI Infra,扩展至文生图、文生视频、文生3D、数字人等全模态底层研发,成为腾讯混元技术研发体系中事实上的一号人物。

合并前,混元算法研发自2025年4月起分为大语言模型部和多模态模型部两条线。姚顺雨2025年9月从OpenAI加入腾讯,12月出任腾讯“CEO/总裁办公室”首席AI科学家,同时兼任AI Infra部和大语言模型部负责人。多模态模型部则由原阿里通义实验室应用视觉团队负责人薄列峰分管。

整合之后,原本分属两个部门的语言基座、多模态生成与理解和AI Infra被放到同一条线上,算力调度、训练框架和数据资源统一分配。多模态模型部原负责人薄列峰在合并后的职务,腾讯尚未公布。

更不用说蒋杰了。

所以,我觉得今天来说,腾讯已经加入了这一轮国产大模型竞速赛阶段。

智谱:

6月17日,智谱上线并开源新一代旗舰大模型GLM-5.2,主攻“长程任务”,让AI不再只做即时问答,而能像人一样连续工作数小时、自主跑完一个完整的大型工程。

在全球百万用户参与盲测的前端开发评估系统Code Arena上,GLM-5.2取得全球可用模型第一;其他评测当中,GLM-5.2与当前海外最强的Claude Opus4.8仅相差约1%–4%,是排名最高的开源模型。

7月底,智谱正式证实,完成对国产AI异构算力软件公司中科加禾(XCore Sigma)的收购。后者源自中科院计算所编译实验室,长期深耕异构算力软件栈及编译优化,被业内视为国内顶尖AI Infra团队之一。

目前,智谱已落地1GW级国产AI算力数据中心建设,并全部采用国产AI芯片。

接下来是GLM-5.3和GLM-5.5,据猜测可能会在下个月发布。

高盛亚洲互联网研究主管 Ronald Keung 判断,中国 AI 公司未来可能不再完全免费开放模型权重,而是向云平台和大型 API 服务商收取商业许可费。

中国模型在海外使用量快速增长,但多数收入流向了负责部署和出售API的平台。模型公司开放了权重,却很难从后续调用中分到钱。

这场围绕中美AI大模型的好戏持续上演。

马斯克在《经济学人》访谈中表示,未来某个时刻中国极有可能成为AI领导者,美国就算禁用中国模型也挡不住。

黄仁勋说,中国大模型非常出色,优秀的开源大模型应该得到使用,上一次市场误解了DeepSeek的影响,这次又误解了Kimi的影响。他认为优秀的开源AI大模型对整个行业大有裨益,技术将扩散到更多行业。黄仁勋认为,DeepSeek、Kimi这样优秀的大模型得到广泛应用,进而会带来巨大的增长。

黄仁勋强调,像Kimi K3这样的中国开源模型“非常出色”,应该允许美国公司使用。同时,他驳斥了关于这些模型可能取代美国实验室的担忧,称这种可能性为零。

相关推荐

DeepSeek V4正式版实测曝光,有望下周发布
今天起,DeepSeek V4成OpenClaw默认模型!
据最新爆料:DeepSeek V4和姚顺雨的新混元模型,将同时于下月发布
传微软评估接入DeepSeek V4替代OpenAI模型
华为与DeepSeek合作开发V4模型,增强中国人工智能自主能力
DeepSeek V4背后,梁文锋的转身
DeepSeek V4的五个关键信号
DeepSeek V4 抛弃英伟达!GPT-6 也要来了?
DeepSeek再放大招,国产大模型坐不住了
DeepSeek春节再扔王炸?官方披露正测试新模型结构

网址: 突发!DeepSeek V4正式版或延至8月中旬,国内大模型竞速生变 https://www.xishuta.cn/newsview152015.html

所属分类:行业热点

推荐科技快讯