当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324

6个月前 (03-25)Deepseek最新资讯481

3月24日晚,DeepSeek发布了模型更新——DeepSeek-V3-0324。本次更新为DeepSeek V3模型的版本更新,并非市场此前一直期待的DeepSeek-V4或R2。目前,其开源版本已上线Hugging Face。据悉,其开源版本模型体积为6850亿参数。

同日,DeepSeek在其官方交流群宣布称,DeepSeek V3模型已完成小版本升级,欢迎前往官方网页、App、小程序试用体验(关闭深度思考),API接口和使用方式保持不变。


从网友反馈的实测效果来看,V3编码能力已经接近 Claude3.7,数学能力也有提升,能像推理模型一样解题。

此前于2024年12月发布的DeepSeek-V3模型曾以“557.6万美金比肩Claude 3.5效果”的高性价比著称,其多项评测成绩超越了Qwen2.5-72B和Llama-3.1-405B等其他开源模型,并在性能上和世界顶尖的闭源模型GPT-4o以及Claude-3.5-Sonnet不分伯仲。但截至目前,还没有任何关于新版 DeepSeek-V3的能力基准测试榜单出现。


其后,DeepSeek于2025年1月发布了性能比肩OpenAI o1正式版的DeepSeek-R1模型,该模型在后训练阶段大规模使用了强化学习技术,在仅有极少标注数据的情况下,极大提升了模型推理能力。

2025年2月25日,市场上也曾出现DeepSeek-R2模型的发布时间或将提前的消息。路透社称,DeepSeek正在加快推出DeepSeek-R1模型的后续产品DeepSeek-R2。据悉,DeepSeek-R2原计划在5月初发布,但公司现在希望尽早推出。

综合/上海证券报、第一财经微信

来源:经济日报


“DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324” 的相关文章

DeepSeek“五一礼包”来了!新开源模型数学推理能力大提升|附实测细节

DeepSeek“五一礼包”来了!新开源模型数学推理能力大提升|附实测细节

赶在五一假期前夕,DeepSeek给我们送出一份惊喜大礼。延续一贯的开源节奏,DeepSeek在Hugging Face正式发布DeepSeek-Prover-V2,并同步上线模型卡及示例代码。此次共...

EasyStack+DeepSeek渐进式构建可进化的AI基础设施

EasyStack+DeepSeek渐进式构建可进化的AI基础设施

当大模型从技术奇点向产业纵深演进,企业正面临AI基础设施的多重挑战:既要通过私有化部署满足数据隐私和安全需求,又要承载百亿、千亿参数规模的澎湃算力;既要应对动态演进的业务需求,又要平衡基础设施的投入成...

中国信通院:启动DeepSeek国产化适配测试工作

中国信通院:启动DeepSeek国产化适配测试工作

中新网北京2月14日电(记者 宋宇晟)近期,DeepSeek陆续开源V3、R1系列高性能、低成本模型,人工智能软硬件协同创新重要性进一步凸显。记者从中国信息通信研究院(简称“中国信通院”)获悉,Dee...

DeepSeek的顺风车,为何只有腾讯元宝成功“上车”?腾讯元宝联动DeepSeek,打出了当年红包大战的风采

DeepSeek的顺风车,为何只有腾讯元宝成功“上车”?腾讯元宝联动DeepSeek,打出了当年红包大战的风采

腾讯元宝联动DeepSeek,打出了当年红包大战的风采@明晰野望原创作者丨茯神腾讯元宝的大模型超车,是开年以来业内最津津乐道的话题。元宝从百模大战小透明,一度跃升至中国区苹果免费App下载排行榜第一。...

信阳市审计局举办DeepSeek专题大数据审计论坛

信阳市审计局举办DeepSeek专题大数据审计论坛

为深入践行科技强审理念,推动审计工作提质增效,2月20日,市审计局举办以人工智能为主题的大数据审计论坛,探讨人工智能技术在审计领域的最新进展及其实际应用。  该局三名年轻大数据审计能手潜心研究、精心准...

腾讯再“出牌”!比DeepSeek-R1便宜3/4的深度思考大模型

腾讯再“出牌”!比DeepSeek-R1便宜3/4的深度思考大模型

在此前35天“更新”30次后,3月21日深夜,腾讯混元大模型团队正式推出了自研深度思考模型混元T1正式版。相比以往,这次深夜“上新”也是腾讯摒弃了传统及主流的纯Transformer架构,首次将混合M...