当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

8个月前 (02-26)Deepseek最新资讯468

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

算力机会再度来袭?DeepSeek R2未发先火,云计算50ETF(516630)或迎布局窗口期

算力机会再度来袭?DeepSeek R2未发先火,云计算50ETF(516630)或迎布局窗口期

5月12日,A股整体震荡向上,主要宽基指数涨多跌少,国防军工板块领涨两市。近日热度较高的云计算50ETF(516630)午后小幅上涨,持仓股中,石基信息、奇安信、千方科技、新易盛、电科数字、中国长城、...

深入探索!DeepSeek软件的强大功能与使用技巧

深入探索!DeepSeek软件的强大功能与使用技巧

标题:深入探索!DeepSeek软件的强大功能与使用技巧关键词:DeepSeek,软件使用,数据分析,搜索技巧,智能工具描述:DeepSeek软件以其卓越的数据分析和精准的搜索能力在市场上赢得了广泛关...

江夏完成DeepSeek大模型私有化部署

江夏完成DeepSeek大模型私有化部署

2月28日江夏区融媒体中心在智能化转型进程中又取得重要突破正式在融媒体生产平台接入DeepSeek大模型江夏也成为了全市首个完成政务环境DeepSeek大模型私有化部署并将其应用于区内主流媒体的城区“...

中公 +DeepSeek,事业单位上岸更稳

中公 +DeepSeek,事业单位上岸更稳

事业单位考试因其稳定的工作环境和良好的福利待遇,吸引了众多求职者的目光,竞争异常激烈。在这场激烈的角逐中,中公教育携手 DeepSeek,为广大考生注入一剂强大的 “上岸助推剂”。在公共基础知识(公基...

联想百应智能体正式官宣引入DeepSeek

联想百应智能体正式官宣引入DeepSeek

近日,联想百应智能体正式官宣引入DeepSeek,二者的结合,将催生出前所未有的创新机遇。DeepSeek以领先的大模型技术实力和超低的训练成本火爆全球,而联想凭借在AI领域的深厚积累,迅速将联想百应...

实达集团完成对DeepSeek-R1应用的部署

实达集团完成对DeepSeek-R1应用的部署

实达集团完成对DeepSeek-R1应用的部署每经AI快讯,有投资者在投资者互动平台提问:请问贵公司是否已经部署了DeepSeek?如果已经部署了,请问主要应用于哪些具体的业务?公司接入DeepSee...