当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布开源周首个成果 可优化英伟达GPU效率

7个月前 (02-24)Deepseek最新资讯347

新京报贝壳财经讯(记者罗亦丹)北京时间2月24日上午,DeepSeek发布了其“开源周”的第一项成果:FlashMLA(直译为快速多头潜在注意力机制)的代码。


据了解,MLA(多头潜在注意力机制)正是DeepSeek降低大模型成本使用的关键技术之一,其可以显著减少大模型训练和推理过程中的内存占用,而FlashMLA则是针对Hopper GPU(一种英伟达GPU架构)开发的高效MLA解码内核,其针对可变长度序列进行了优化,目前已投入了生产,其可以使得H800达到3000GB/s内存,实现580TFLOPS(每秒浮点运算次数)计算性能。


贝壳财经记者注意到,根据此前DeepSeek发布V3大模型时公开的技术文档,该大模型正是使用英伟达的H800芯片训练而成。


上海骊翰科技咨询有限公司发文称,FlashMLA能在不损失模型性能的前提下,将缓存体积压缩至原来的1/4,从而大幅降低显存需求。例如,原始需要存储的100GB中间结果,压缩后仅需25GB,通过开源让企业可以直接使用FlashMLA来优化自家模型。随着FlashMLA的普及,AI推理有望进入千元级硬件跑百亿模型的时代。


“DeepSeek发布开源周首个成果 可优化英伟达GPU效率” 的相关文章

DeepSeek总结最浪费时间的7大行为,看完我开始深度反思

DeepSeek总结最浪费时间的7大行为,看完我开始深度反思

鲁迅有句名言,影响了我很多年。他说:“生命是以时间为单位的,浪费别人的时间等于谋财害命;浪费自己的时间,等于慢性自杀。”而很多人几乎每天都在慢性自杀,只是他们自己从未察觉。DeepSeek通过大数据统...

博士有成"智学舱"重磅上市:DeepSeek驱动学习空间革命,重新定义智能学习场

博士有成"智学舱"重磅上市:DeepSeek驱动学习空间革命,重新定义智能学习场

在科技日新月异的今天,智能化已经渗透到我们生活的方方面面。博士有成,作为学习桌椅行业的佼佼者,再次以科技为驱动,在行业内率先实现搭载DeepSeek设备直驱的“智学舱”学习桌。这款产品的问世,标志着学...

安徽率先完成DeepSeek满血版本地化部署全省试用推广

安徽率先完成DeepSeek满血版本地化部署全省试用推广

人民财讯3月11日电,据安徽日报,记者3月10日从安徽省数据资源管理局获悉,安徽省率先在全国省级层面完成DeepSeek满血版(671B)本地化部署,推出无差别综窗、公文写作、语音转文字等16个典型应...

Word如何接入DeepSeek?手把手教你AI自动化办公

Word如何接入DeepSeek?手把手教你AI自动化办公

DeepSeek与Word的梦幻联动,将为你开启高效办公的新篇章!熟悉的Word界面中,只需轻点鼠标,就能召唤出强大的DeepSeek,让它为你快速检索信息、精准翻译文本、智能生成内容…… 告别在不同...

美商务部禁止在政府设备上用DeepSeek?

美商务部禁止在政府设备上用DeepSeek?

本报记者 李 萌路透社17日报道称,根据该媒体及知情人士了解,美国商务部下属一些部门最近几周通知员工,禁止在政府设备上使用中国的人工智能(AI)模型DeepSeek。路透社称,美商务部在发给工作人员的...

DeepSeek 强势入局,全球 AI 市场竞争格局新走向

DeepSeek 强势入局,全球 AI 市场竞争格局新走向

DeepSeek在算法、框架与硬件的优化为 AI 领域带来突破性创新,包括其开源特性与聚焦推理效率的设计,让DeepSeek模型能减少对庞大算力的依赖,其推理能力比肩其他现有的AI模型。DeepSee...