当前位置:首页 > DeepSeek技术交流 > 正文内容

DeepSeek V3升级版发布:编程数学能力接近Claude 3.7

3个月前 (03-25)DeepSeek技术交流244

DeepSeek于24日夜间发布V3模型小版本升级,新版本DeepSeek-V3-0324在模型参数上达到685B,并采用MIT许可证,为用户带来全新体验。该版本重点提升了数学和编程能力,性能接近Claude 3.7 Sonnet,且对用户免费开放使用。

模型架构全面升级

DeepSeek-V3作为专家混合巨头模型,原始参数为671B,每个Token可激活370亿个参数。新版本DeepSeek-V3-0324的模型参数提升至685B,采用多头潜在注意力和DeepSeek MoE技术支持。知识截止日期从2023年12月延长至2024年7月,优化了Function call功能,解决了此前版本的函数调用问题。

编程能力显著提升

在前端编程领域,DeepSeek V3-0324展现出惊人实力。测试显示,其能在3分钟内完成750行电商网站代码,包含动态产品卡片悬停效果和手机端响应式布局等功能。自2024年6月以来,业界普遍认为仅Claude 3.5能够生成优质前端代码,而此次DeepSeek的升级版本终于为Anthropic带来了强劲竞争对手。在数学能力方面,V3-0324也表现出色,成功解答了此前大模型普遍解答错误的数学题目。

开源协议引领行业变革

DeepSeek V3-0324采用MIT许可证,允许用户出于任何目的使用、修改和分发模型,包括商业用途。这一决策获得业内广泛关注,Perplexity CEO阿拉文德认为,DeepSeek的开源策略具有革命性意义。该模型不仅能在AWS和Azure上以极低成本部署,仅需支付服务器费用,还为创业企业提供了可负担的AI解决方案。这种开源模式可能影响未来AI巨头的融资格局,推动行业向更开放、更透明的方向发展。

本文源自:金融界


“DeepSeek V3升级版发布:编程数学能力接近Claude 3.7” 的相关文章

幸福廊坊智慧城市平台正式接入DeepSeek

幸福廊坊智慧城市平台正式接入DeepSeek

河北日报客户端讯(刘英、刘杰、卢晔)2月20日,幸福廊坊App上线基于DeepSeek大模型的智能AI助手服务,可为用户提供免费顺畅的智能问答服务,有效提升便民惠企水平。同时,廊坊市市级政务云同步接入...

宿州以DeepSeek大模型打通“未来之门”

宿州以DeepSeek大模型打通“未来之门”

未来已来。随着chatGPT等大模型,特别是本土大数据语言模型DeepSeek的横空出世,数字化浪潮汹涌而来,人类进入大数据人工智能时代。进入大数据时代,抓好数字化转型,就是抓住了未来。聚“数”集“算...

保姆级教程:DeepSeek+即梦AI 快速生成图文海报(含思维导图笔记)

保姆级教程:DeepSeek+即梦AI 快速生成图文海报(含思维导图笔记)

Deepseek+即梦AI生成图文海报详细教程来啦,文末还整理成了竖屏思维导图笔记,一图get关键点!Hi,我是做思维导图笔记的小贤!一个好消息!即梦AI 接入Deepseek啦!生图或生视频效率起飞...

天阳科技:已发布DeepSeek版本多款大模型产品

天阳科技:已发布DeepSeek版本多款大模型产品

金融界4月30日消息,有投资者在互动平台向天阳科技提问:尊敬的领导:您们好!贵公司在人工智能、机器人、大模型领域的布局进展如何?公司回答表示:目前,公司已陆续发布DeepSeek版本的多款大模型产品,...

广东全省推进DeepSeek部署,开启AI智能服务新篇章!

广东全省推进DeepSeek部署,开启AI智能服务新篇章!

拥抱AI浪潮 加速AI赋能近期,AI系统DeepSeek依托先进的深度学习算法和强大的数据处理能力火热出圈。中国电信广东公司积极拥抱AI浪潮,依托天翼云强大的算力资源和技术优势,为DeepSeek在广...

北京企业登记首次接入DeepSeek

北京企业登记首次接入DeepSeek

“您好,我想注册一家公司,需要什么材料?”登录北京市企业服务e窗通平台输入需求后,智能问答助手“市监小e”即刻开始了工作:“好的,请您先确认拟设立的主体类型……”经过简短沟通,小e迅速理解了办事人的需...