当前位置:首页 > Deepseek应用场景 > 正文内容

比肩 H100!硅基流动上线基于昇腾云 CloudMatrix 超节点的 DeepSeek-R1

4个月前 (04-11)Deepseek应用场景244

近日,硅基流动创始人袁进辉在华为云生态大会上宣布,硅基流动联合华为云基于 CloudMatrix 384超节点昇腾云服务和高性能推理框架 SiliconLLM,用大规模专家并行最佳实践正式上线 DeepSeek-R1。

该服务在保证单用户 20 TPS水平前提下,单卡 Decode吞吐突破 1920 Tokens/s,可比肩 H100 部署性能。同时,经过主流测试集验证及大规模线上盲测,在昇腾算力部署 DeepSeek-R1的模型精度与 DeepSeek官方保持一致。


其中,通过架构的全面创新,基于新型高速总线架构的 CloudMatrix超节点集群在总算力、互联带宽、内存带宽上领先业界。

此前,硅基流动在大模型云服务平台 SiliconCloud首发推出了基于昇腾云的稳定生产级 DeepSeek-V3 & R1 推理服务,并支持模型私有化集群部署,这次合作推动基于国产算力的 DeepSeek-R1推理服务持续升级。


DeepSeek风暴席卷全球,特别是以其高效、低成本的 MoE架构为应对大模型推理挑战打开了局面。不过,如果没有强大的 AI Infra 技术能力,要想部署好 DeepSeek并非易事。

DeepSeek使用了大规模专家并行(Expert Parallelism,大 EP并行)的 MoE模型架构,若采用单机部署方案,最终的性能远不如 DeepSeek官方公布的部署方案,且至少有数倍成本差距。更具挑战的是,虽然 DeepSeek公开了大 EP 并行方案,但技术难度较大,业内还没有其他团队快速复现这一部署方法。

针对这些难题,硅基流动与华为云联合攻关实现了技术突破。我们在 CloudMatrix 384超节点昇腾云服务上部署 DeepSeek-R1 时采纳了大规模专家并行方案,通过多专家负载均衡和极致通信优化,实现高吞吐及更高性能,大幅提升了用户体验。同时,我们使用昇腾高性能算子库,以及硅基流动推理加速框架 SiliconLLM在模型、机制、算子上的协同优化,实现在国产算力上,不损失模型精度的情况下,获得 DeepSeek-R1 推理效率与资源利用率的显著提升。

硅基流动与华为云的合作不仅提供坚实的全国产软硬件体系部署方案,让 DeepSeek推理服务更经济高效,也展现了 AI 生态合作的强大能量。硅基流动将继续加深与华为云的联合创新,共同提升产品体验,加速模型在更多场景落地。


“比肩 H100!硅基流动上线基于昇腾云 CloudMatrix 超节点的 DeepSeek-R1” 的相关文章

deepseek能直接生成ppt吗?

deepseek能直接生成ppt吗?

deepseek能直接生成ppt吗?目前DeepSeek作为文本生成模型,无法直接生成PPT文件,但可以通过以下方式辅助制作专业演示文稿:一、文案生成技巧标题优化复制代码“生成10个科技风PPT标题,...

别踩坑!DeepSeek官方发布声明

别踩坑!DeepSeek官方发布声明

DeepSeek“网课热”背后:消费者是如何被步步“收割”的?随着国产AI大模型DeepSeek的爆火,近期市场上出现大批炒作DeepSeek概念的网络课程,更有卖课机构推出利用DeepSeek“搞钱...

“桥梁+DeepSeek”,上百种桥梁病害一键匹配!技术小白也能轻松使用

“桥梁+DeepSeek”,上百种桥梁病害一键匹配!技术小白也能轻松使用

DeepSeek爆火以来,大家有问题都习惯先问一问,但对特定领域的专业诉求时,其回答往往深度还有欠缺。3月12日,极目新闻记者从中铁大桥局桥科院获悉,其研发的人工智能“桥头堡·智能体”,用户使用这一软...

“云”栖山水境,茶醉一“县”春!与DeepSeek共游云南宝藏小城

“云”栖山水境,茶醉一“县”春!与DeepSeek共游云南宝藏小城

这是藏在横断山南部山脉峡谷中的“山水画廊”,是镶嵌在澜沧江畔的璀璨明珠,是云南唯一以“云”字命名的县。让我们跟着DeepSeek的脚步,走进有一个叫“云”的地方——“沧江明珠”云县。远山碧水 相映升辉...

深圳港集团实现DeepSeek大模型本地化部署

深圳港集团实现DeepSeek大模型本地化部署

每经AI快讯,据深圳港集团公众号消息,在全球生成式AI技术蓬勃发展的浪潮中,针对港口行业数据安全与响应效率的特殊需求,深圳港集团数字化创新中心携手盐田港资讯公司和盐田国际公司,成功实现DeepSeek...

DeepSeek概念股普遍加大绿电使用并升级算力 专家提醒注意碳排放数据真实性

DeepSeek概念股普遍加大绿电使用并升级算力 专家提醒注意碳排放数据真实性

“因为自己淋过雨,所以想为他人撑一把伞。”李连才是科大讯飞(SZ002230,股价47.86元,市值1106亿元)程序员,也是一位在黑暗中摸索的视障者。在2025年4月讯飞星火智能体挑战赛中,他为视障...