当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库

4个月前 (02-25)Deepseek最新资讯221

【DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库】财联社2月25日电,DeepSeek在“开源周”的第二天向公众开源了DeepEP。据介绍,DeepEP是第一个用于MoE(混合专家)模型训练和推理的EP(Expert Parallelism,专家并行)通信库,可以实现高效且优化的全对全通信,支持包括FP8在内的低精度运算,适配现代高性能计算需求。同时,DeepEP针对NVLink到RDMA的非对称带宽转发场景进行了深度优化,不仅提供了高吞吐量,还支持SM(Streaming Multiprocessors)数量控制,兼顾训练和推理任务的高吞吐量表现。对于延迟敏感的推理解码场景,DeepEP还提供了纯RDMA的低延迟内核,支持自适应路由,能实现更灵活的GPU资源控制,满足不同场景需求。

“DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库” 的相关文章

清华团队推出“安全增强版DeepSeek”

清华团队推出“安全增强版DeepSeek”

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显...

全市首个!大兴人才服务平台用上DeepSeek大模型

全市首个!大兴人才服务平台用上DeepSeek大模型

 为深入推进北京高水平人才高地建设,进一步提升地区人才宣传服务质量,创新打造区级独立人才服务宣传综合展示平台,全面实施“求贤、集贤、礼贤”三大人才工程,努力实现人才服务“随时查”“掌上办”,助力区域产...

DeepSeek API 的返回值格式是什么?

DeepSeek API 的返回值格式是什么?

DeepSeek API 的返回值格式是什么?DeepSeek API的返回值格式通常是JSON格式。这种格式返回的数据包括生成的文本内容、状态码(用于判断请求是否成功)、错误信息(若请求失败时)等。...

中国电信咸阳分公司助力政务平台成功接入DeepSeek

中国电信咸阳分公司助力政务平台成功接入DeepSeek

2月19日,中国电信咸阳分公司助力“咸企通”平台接入中国电信自有算力适配的DeepSeek大模型,成功打造全省首个基于星辰大模型的AI政策服务的综合性平台。在原有中国电信“星辰大模型”的基础上,“咸企...

华为鸿蒙电脑接入DeepSeek:生产力更强

华为鸿蒙电脑接入DeepSeek:生产力更强

驱动之家5月10日消息,在今日举办的星耀智能手表技术与生态发布会上,星耀智能手表正式闪耀登场。据介绍,星耀智能手表搭载了StarOS 3.0,采用星耀自研内核,带来精准、便捷、健康、时尚、互联的体验。...

小旺AI截图+DeepSeek:5MB工具如何颠覆传统截图软件?

小旺AI截图+DeepSeek:5MB工具如何颠覆传统截图软件?

在数字化办公场景中,截图工具是用户使用频率最高的效率软件之一。然而,传统截图软件长期面临功能单一、操作繁琐、资源占用高等痛点。近日,一款名为小旺AI截图的PC端工具正式上线,凭借仅5MB的轻量化设计、...