DeepSeek R2 推迟发布:因 H20 算力短缺
DeepSeek 今年早些时候凭借其 R1 AI 模型备受广泛关注。据《The Information》报道,R2 模型的工作似乎因 H20 处理器而停滞不前。

DeepSeek尚未透露其R2 模型的具体上市时间。
DeepSeek 使用 5 万块 Hopper GPU(包括 3 万块 H20、1 万块 H800 和 1 万块 H100)组成的庞大集群来训练其 R1 模型。
目前尚不清楚 R2 是否已经完成了全面的预训练工作。
《The Information》报道称,DeepSeek 团队一直在深入研究开发 R2 模型,但 CEO 梁文锋对其性能尚不满意。团队仍在内部努力提升性能。
据《The Information》报道,如果 DeepSeek 即将推出的 R2 模型其性能超过目前市面上的开放替代模型,预计使用量将激增,超出中国云平台的处理能力。
据称,大多数依赖早期R1 模型的组织都使用H20 来运行该模型,而这款处理器已经被美国限制,目前出现了供应短缺的局面。
经@大单网 查询,目前 DeepSeek 相关的招投标项目达 1000 + 个。


发布于:北京
相关推荐
DeepSeek R2 推迟发布:因 H20 算力短缺
DeepSeek-R2引爆芯片革命!国产算力掀涨停潮,三路资金抢筹名单
DeepSeek R2来了?联合清华大学发布推理时Scaling突破性论文
DeepSeek V3到V3.1,走向国产算力自由
DeepSeek R2有望8月下旬发布?内部人士:不属实
“DeepSeek R2+昇腾”王炸组合来袭!华为算力独家供应商,坐等起飞!
K时评:DeepSeek R2,翘首以盼
黄仁勋预警:DeepSeek联手华为昇腾,美国算力布局或将一败涂地
DeepSeek V4 抛弃英伟达!GPT-6 也要来了?
DeepSeek V3.1 发布,更令人好奇的是UE8M0 FP8
网址: DeepSeek R2 推迟发布:因 H20 算力短缺 https://www.xishuta.cn/newsview138111.html
推荐科技快讯
- 1问界商标转让释放信号:赛力斯 95792
- 2报告:抖音海外版下载量突破1 25736
- 3人类唯一的出路:变成人工智能 25175
- 4人类唯一的出路: 变成人工智 24611
- 5移动办公如何高效?谷歌研究了 24309
- 6华为 nova14深度评测: 13155
- 7滴滴出行被投诉价格操纵,网约 11888
- 82023年起,银行存取款迎来 10774
- 9五一来了,大数据杀熟又想来, 9794
- 10手机中存在一个监听开关,你关 9519
