当前位置:首页 > DeepSeek技术交流 > 正文内容

DeepSeek V3升级版发布:编程数学能力接近Claude 3.7

4个月前 (03-25)DeepSeek技术交流325

DeepSeek于24日夜间发布V3模型小版本升级,新版本DeepSeek-V3-0324在模型参数上达到685B,并采用MIT许可证,为用户带来全新体验。该版本重点提升了数学和编程能力,性能接近Claude 3.7 Sonnet,且对用户免费开放使用。

模型架构全面升级

DeepSeek-V3作为专家混合巨头模型,原始参数为671B,每个Token可激活370亿个参数。新版本DeepSeek-V3-0324的模型参数提升至685B,采用多头潜在注意力和DeepSeek MoE技术支持。知识截止日期从2023年12月延长至2024年7月,优化了Function call功能,解决了此前版本的函数调用问题。

编程能力显著提升

在前端编程领域,DeepSeek V3-0324展现出惊人实力。测试显示,其能在3分钟内完成750行电商网站代码,包含动态产品卡片悬停效果和手机端响应式布局等功能。自2024年6月以来,业界普遍认为仅Claude 3.5能够生成优质前端代码,而此次DeepSeek的升级版本终于为Anthropic带来了强劲竞争对手。在数学能力方面,V3-0324也表现出色,成功解答了此前大模型普遍解答错误的数学题目。

开源协议引领行业变革

DeepSeek V3-0324采用MIT许可证,允许用户出于任何目的使用、修改和分发模型,包括商业用途。这一决策获得业内广泛关注,Perplexity CEO阿拉文德认为,DeepSeek的开源策略具有革命性意义。该模型不仅能在AWS和Azure上以极低成本部署,仅需支付服务器费用,还为创业企业提供了可负担的AI解决方案。这种开源模式可能影响未来AI巨头的融资格局,推动行业向更开放、更透明的方向发展。

本文源自:金融界


“DeepSeek V3升级版发布:编程数学能力接近Claude 3.7” 的相关文章

DeepSeek是中国AI市场的“鲶鱼”?

DeepSeek是中国AI市场的“鲶鱼”?

2025年春节前后,DeepSeek凭借开源多模态模型Janus-Pro与DeepSeek-R1推理模型的发布,以“低成本、高性能”的颠覆性优势横扫全球市场。其开源策略不仅让开发者以API调用成本仅为...

deepseek无法响应怎么办

deepseek无法响应怎么办

deepseek无法响应怎么办如果您遇到DeepSeek无法响应的情况,可以尝试以下几种方法来解决问题:错峰使用:尽量避免在工作日的工作时间、晚上以及周末等高峰时段使用DeepSeek。可以选择在清晨...

DeepSeek在山东港口日照港落地应用

DeepSeek在山东港口日照港落地应用

在DeepSeek赋能千行百业的浪潮中,港口如何抓住机遇,培育和发展新质生产力?日前,山东港口日照港在私有化部署国产开源大模型DeepSeek R1基础上,上线日照港流动设备智慧运维平台,首次实现De...

怎么恢复误删的 DeepSeek 模型?

怎么恢复误删的 DeepSeek 模型?

怎么恢复误删的 DeepSeek 模型?要恢复误删的 DeepSeek 模型,可以尝试以下步骤:检查版本历史:打开 DeepSeek 界面,查找右上角的时间钟图标,点击进入。在这里,你可以看到之前所有...

科技伦理视域下DeepSeek的学术风险及其防范

科技伦理视域下DeepSeek的学术风险及其防范

作者:刘科(河南师范大学科技与社会研究所教授);贾豫政(河南师范大学科技与社会研究所助理研究员)近期,人们对DeepSeek(深度求索)的热议揭示了人机关系的复杂性,也凸显了在AI领域嵌入科技伦理的必...

福建泉州:部署DeepSeek大模型,助力智慧教学

福建泉州:部署DeepSeek大模型,助力智慧教学

 中国教育报-中国教育新闻网讯(记者 黄星)日前,福建省泉州市中小学校人工智能素养能力提升培训在泉州市晋光小学东海校区举行。  活动现场,泉州市晋光小学教师许榕鑫在语文课堂上运用AI生图技术,引导学生...