当前位置:首页 > Deepseek最新资讯 > 正文内容

全面适配!京东云将DeepSeek推理场景性能提升50%

8个月前 (03-03)Deepseek最新资讯481

央广网北京3月3日消息 在DeepSeek为期五天的“开源周”中,其连续开源的五大核心技术(FlashMLA、DeepEP、DeepGEMM、DualPipe & EPLB、3FS文件系统),惊艳全球。

京东云率先宣布完成对这五项技术的全栈适配,在模型推理效率、算力资源利用率及数据管理等领域实现突破性优化,综合Flash MLA、DeepEP、FP8 GEMM、DualPipe四方面的调优,在DeepSeek推理场景下性能提升50%。

全面适配五大技术,DeepSeek推理场景性能提升50%

作为DeepSeek开源首日的重磅技术,Flash MLA通过动态调度GPU的显存与算力资源,解决了传统方法处理变长序列时的资源浪费问题。

京东vGPU AI算力平台通过支持Flash MLA的FP8格式来提升推理性能,使单Token的 KV Cache显存占用相比Multi-head Attention降低57倍,配合最新的投机推理技术,以极低的显存需求,在高并发请求场景下保证了推理的吞吐量和延迟表现。

此外,针对用于DeepSeek开源的通信库DeepEP,京东云vGPU AI算力平台已全面支持EP模式下的分布式推理,显著提高推理吞吐。通过整合DeepEP作为通信后端,针对机内通信使用NVLink传输数据,机间通信使用NVSHMEM接口走RDMA网络,同时通过灵活的GPU SM数量利用控制,增大GPU算力资源利用率以及减少对计算算子的性能串。

更低成本更高效率,让大模型真正用起来

针对客户大模型的使用需求,京东云vGPU AI算力平台,为用户提供更高推理性能、更多国产芯片适配、更多高数据安全的大模型服务,让大模型真正用起来。

在推理性能方面,针对DeepSeek大模型技术特点,京东云通过推理加速与内核驱动级优化,提升单台服务器推理性能50%。

在国产芯片适配方面,京东云已完成从底层算力到大模型和业务应用的全面国产化适配,包括十余家国产化AI算力,确保自主可控。

在数据安全方面,通过机密容器AI全场景密态计算和先进的容器隔离技术,确保模型数据的机密性与完整性,为用户提供金融级安全防护。

目前,在河南鹤壁、江苏宿迁、山东滨州、广西北海、山西大同,京东云已经助力多地政府基于现有基础设施本地化部署DeepSeek,既满足本地政务业务,又让当地企业不用投入资源,即可通过政务云调用DeepSeek。


标签: DeepSeek

“全面适配!京东云将DeepSeek推理场景性能提升50%” 的相关文章

河南省公共资源交易中心接入部署DeepSeek “人工智能+”让公共资源交易“加数跑”

河南省公共资源交易中心接入部署DeepSeek “人工智能+”让公共资源交易“加数跑”

近日,经营主体登录河南省公共资源交易中心(以下简称“省交易中心”)官网进行网上咨询,不用提出问题后焦急等待人工回复,只需在“智能咨询”栏目中输入问题,即可获得“秒级响应、全网检索、深度解析、即时解答”...

联想AI智能、AI一体机快速接入,满血版DeepSeek成国产AI鲶鱼

联想AI智能、AI一体机快速接入,满血版DeepSeek成国产AI鲶鱼

近期,各类终端企业“紧跟热点”,纷纷高调宣布接入满血版DeepSeek,正式开启DeepSeek接入潮。其中,联想不仅率先推出了首个国产DeepSeek一体机解决方案,其个人智能体“小天”和联想百应智...

DeepSeek高效赋能,“翼”同跑出就业“加速度”

DeepSeek高效赋能,“翼”同跑出就业“加速度”

2025年春季校园招聘正在如火如荼地进行,中国电信南通分公司将DeepSeek引入大学生就业指导课堂,辅导毕业生巧用AI科技高效求职,以数智赋能助力南通市人才服务中心就业服务创新升级。课程聚焦毕业生求...

希荻微:办公系统已接入基于Deepseek模型的提效工具

希荻微:办公系统已接入基于Deepseek模型的提效工具

金融界3月10日消息,有投资者在互动平台向希荻微提问:董秘您好!请问贵公司是否已经部署了DeepSeek?如果已经部署了,请问主要应用于哪些具体的业务?公司接入DeepSeek有哪些成本、收益方面的考...

DeepSeek能否煮沸老板电器的"冷灶"?

DeepSeek能否煮沸老板电器的"冷灶"?

老板电器中年危机:营收微增利降,推AI食神模型突围。倘若你问一个小学生,AI为你带来了什么。小孩儿哥可能会说“写作业可方便了,爸爸再也不用打我了”。但你要问一个厨子,他大概率会说,再也不用担心给孩子辅...

阿加犀把DeepSeek装进终端,给机器人配个“离线军师”

阿加犀把DeepSeek装进终端,给机器人配个“离线军师”

金融投资报记者 薛蕾近日,国产AI公司深度求索发布的大模型DeepSeek引发全球关注,在各行各业掀起AI生态布局热潮。随着越来越多企业加入部署DeepSeek的行列,持观望态度的从业者不禁思考:在众...