当前位置:首页 > Deepseek最新资讯 > 正文内容

华安证券-计算机行业周报:DeepSeek~V3.2~Exp 发布,训练推理提效

  技术层面:1)DeepSeek Spare Attention(DSA)首次实现细粒度稀疏注意力机制,在几乎不影响模型输出效果的前提下,实现长文本训练和推理效率的大幅提升。根据各领域性能公开评测集结果(通用、搜索、代码、代码智能体、数学),DeepSeek-V3.2-Exp表现与V3.1-Terminus基本持平;2)开源TileLang与CUDA两种算子,TileLang由北大团队研发,专为简化高难度GPU算子开发而设计,将成为替代主流OpenAI领域特定语言Triton的有力备选,TileLang将调度空间与数据流解耦,使开发者能够直观地控制数据在硬件中的流动,根据TileLang在GitHub的说明文档,不仅支持英伟达CUDA,还已扩展支持华为昇腾等国产芯片。DeepSeek使用高级语言TileLang进行快速原型开发,以支持更深入的探索。在最后阶段deepseek,以TileLang作为精度基线,逐步使用底层语言实现更高效的版本。

  受益于新模型服务成本大幅降低,API调用价格相应下调。目前DeepSeek-V3.2-Exp API价格为输入0.2元/百万tokens(缓存命中),2元/百万tokens(缓存未命中),输出3元/百万tokens。

  新价格政策下开发者调用DeepSeek API的成本将降低50%以上。我们认为,DeepSeek-V3.2-Exp在技术层面探索了新的稀疏注意力机制,推动中国算力生态协同创新与演进,进一步将模型与算法层面的创新,与中间层的编译语言与更底层的计算芯片协同起来,推动中国算力生态的成长。模型发布后华为昇腾和寒武纪均第一时间宣布完成适配工作,表明国产AI算力生态已进入模型与芯片协同设计阶段。相关公司:神州数码、寒武纪、品高股份、北京利尔、安博通、优刻得、浪潮信息、紫光股份、超讯通信、首都在线。

  1)下游预算限制信息化支出;2)财政与货币政策低于预期;3)供应链波动加大,影响科技产业发展。原文出处:华安证券-计算机行业周报:DeepSeek~V3.2~Exp 发布,训练推理提效,API同步降价-251012,感谢原作者,侵权必删!

标签: deepseek

“华安证券-计算机行业周报:DeepSeek~V3.2~Exp 发布,训练推理提效” 的相关文章

青云上线DeepSeek-V3.1-Terminus,更强Agent能力

青云上线DeepSeek-V3.1-Terminus,更强Agent能力

  青云科技旗下 AI 算力云服务——基石智算CoresHub 已上线DeepSeek-V3.1-Terminus 新版模型,用户可立即在线体验或通过调用 API 使用deepseek。...

《MIT科技评论》“50家聪明公司”发布,Deepseek、游戏科学入选

《MIT科技评论》“50家聪明公司”发布,Deepseek、游戏科学入选

  AI 驱动下药物研发正在将发现周期显著缩短;材料科学在以更高性能和更智能的表现探索新的应用;可复用火箭和卫星数据分析正在解析太空经济潜力的“密码”……昨天(12日),EmTech Ch...

算力大事件!中国算力大会举行,DeepSeek新模型适配下一代国产芯片

算力大事件!中国算力大会举行,DeepSeek新模型适配下一代国产芯片

  我国在用算力中心标准机架达1085万架,智能算力规模达788 EFLOPS,干线400G端口数量大幅增加至14060个,存力总规模超过1680 EB,全国算力中心平均电能利用效率(PU...

DeepSeek预测:阿森纳vs西汉姆联!枪手主场血洗铁锤帮?哲凯赖什+萨卡双星

DeepSeek预测:阿森纳vs西汉姆联!枪手主场血洗铁锤帮?哲凯赖什+萨卡双星

  北京时间10月4日晚22点,英超第7轮将上演伦敦德比,目前排名第2的阿森纳坐镇酋长球场迎战倒数第2的西汉姆联。枪手近期状态火热,近10场7胜2平1负(进19球失6球),而铁锤帮近10场...

晚报 万亿市场,百亿补贴!DeepSeek-R2再传发布时间!就在今晚!换帅后的

晚报 万亿市场,百亿补贴!DeepSeek-R2再传发布时间!就在今晚!换帅后的

  沪指放量上涨0.50%逼近去年10月8日高点、创指涨超1%、科创50涨近2% AI硬件概念全线爆发。三大指数全天高开高走,截至收盘,沪指涨0.50%,深证成指涨0.53%,创业板指涨1...

DeepSeek又更新了,期待梁文锋“炸场”

DeepSeek又更新了,期待梁文锋“炸场”

  《BUG》栏目实测发现,升级后的DeepSeek在上下文长度和交互友好度上有明显改进,编程能力受到推崇。在使用经济性上,也有开发人员指出,“DeepSeek或将V3与R1模型进行了合并...