当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库

7个月前 (02-25)Deepseek最新资讯402

【DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库】财联社2月25日电,DeepSeek在“开源周”的第二天向公众开源了DeepEP。据介绍,DeepEP是第一个用于MoE(混合专家)模型训练和推理的EP(Expert Parallelism,专家并行)通信库,可以实现高效且优化的全对全通信,支持包括FP8在内的低精度运算,适配现代高性能计算需求。同时,DeepEP针对NVLink到RDMA的非对称带宽转发场景进行了深度优化,不仅提供了高吞吐量,还支持SM(Streaming Multiprocessors)数量控制,兼顾训练和推理任务的高吞吐量表现。对于延迟敏感的推理解码场景,DeepEP还提供了纯RDMA的低延迟内核,支持自适应路由,能实现更灵活的GPU资源控制,满足不同场景需求。

“DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库” 的相关文章

风险vs机遇!近百家公司抢搭“DeepSeek快车”

风险vs机遇!近百家公司抢搭“DeepSeek快车”

DeepSeek大热,风险与机遇并存。自蛇年新春开市以来,A股刮起两股风,一是“哪吒风”,二是“DeepSeek风”。A股市场上,一场围绕着以DeepSeek为中心的投资盛宴火热开启,几乎沾上Deep...

黄山AI旅行助手全面接入DeepSeek大模型

黄山AI旅行助手全面接入DeepSeek大模型

上证报中国证券网讯(记者 杨翔菲)记者2月21日从黄山旅游获悉,日前,公司旗下途马科技已将黄山AI旅行助手全面接入DeepSeek大模型。此举成为文旅产业与人工智能深度融合的里程碑,黄山景区将成为国内...

浙江大学推出DeepSeek系列专题线上公开课

浙江大学推出DeepSeek系列专题线上公开课

近日,DeepSeek风靡全球,其对算法、模型和系统等进行的系统级协同创新,为迈向通用人工智能(AGI)的技术突破带来无限遐想。为系统解析DeepSeek在技术、应用与伦理交织演进下的革新性探索,加深...

洛江打造泉州首个接入DeepSeek卫品行业智能体

洛江打造泉州首个接入DeepSeek卫品行业智能体

 近日,洛江区工信局、数据管理局持续推进人工智能与实体经济深度融合,成功指导泉州天娇妇幼卫生用品有限公司率先实现DeepSeek私有化部署并深度融入车间生产流程,形成“问题上报-分析-解决-归档”闭环...

佳缘科技(301117.SZ)AI服务器集群完成Deepseek大模型的本地化部署

佳缘科技(301117.SZ)AI服务器集群完成Deepseek大模型的本地化部署

佳缘科技(301117.SZ)AI服务器集群完成Deepseek大模型的本地化部署近日,佳缘科技(股票代码:301117.SZ)在投资者互动交流平台上积极回应投资者关切,正式对外表示,公司已顺利完成内...

广东江门:举办DeepSeek大模型专题培训

广东江门:举办DeepSeek大模型专题培训

为帮助干部职工及时掌握前沿人工智能技术,提升数字化办公能力,近日,广东省江门市退役军人事务局举办DeepSeek大模型专题培训。培训会上,老师从DeepSeek简介、如何使用DeepSeek、Deep...