当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324

1个月前 (03-25)Deepseek最新资讯155

3月24日晚,DeepSeek发布了模型更新——DeepSeek-V3-0324。本次更新为DeepSeek V3模型的版本更新,并非市场此前一直期待的DeepSeek-V4或R2。目前,其开源版本已上线Hugging Face。据悉,其开源版本模型体积为6850亿参数。

同日,DeepSeek在其官方交流群宣布称,DeepSeek V3模型已完成小版本升级,欢迎前往官方网页、App、小程序试用体验(关闭深度思考),API接口和使用方式保持不变。


从网友反馈的实测效果来看,V3编码能力已经接近 Claude3.7,数学能力也有提升,能像推理模型一样解题。

此前于2024年12月发布的DeepSeek-V3模型曾以“557.6万美金比肩Claude 3.5效果”的高性价比著称,其多项评测成绩超越了Qwen2.5-72B和Llama-3.1-405B等其他开源模型,并在性能上和世界顶尖的闭源模型GPT-4o以及Claude-3.5-Sonnet不分伯仲。但截至目前,还没有任何关于新版 DeepSeek-V3的能力基准测试榜单出现。


其后,DeepSeek于2025年1月发布了性能比肩OpenAI o1正式版的DeepSeek-R1模型,该模型在后训练阶段大规模使用了强化学习技术,在仅有极少标注数据的情况下,极大提升了模型推理能力。

2025年2月25日,市场上也曾出现DeepSeek-R2模型的发布时间或将提前的消息。路透社称,DeepSeek正在加快推出DeepSeek-R1模型的后续产品DeepSeek-R2。据悉,DeepSeek-R2原计划在5月初发布,但公司现在希望尽早推出。

综合/上海证券报、第一财经微信

来源:经济日报


“DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324” 的相关文章

为算力超市夯实底座 实现“DeepSeek自由”

为算力超市夯实底座 实现“DeepSeek自由”

在近日举行的 2025 年“智算申城”高峰论坛上,由上海电信牵头打造的长三角一体化示范区异构智算云网调度平台,因其在跨区域、跨架构算力资源智能调度方面的创新性和引领性,成功摘得一等奖。在此前举行的第二...

中兴通讯发布AiCube DeepSeek一体机

中兴通讯发布AiCube DeepSeek一体机

人民财讯3月19日电,MWC25巴塞罗那展会期间,中兴通讯正式发布AiCube DeepSeek一体机,为企业提供高效的大模型商业化解决方案。AiCube DeepSeek一体机通过集成高算力硬件,易...

百度AI搜索——不限量稳定使用DeepSeek-R1满血联网版

百度AI搜索——不限量稳定使用DeepSeek-R1满血联网版

百度AI搜索——不限量稳定使用DeepSeek-R1满血联网版AI搜索已接入满血联网版Deepseek-R1,一键开启深度思考,即可免费使用最新版Deepseek-R1完成各类推理任务。...

天津渤化集团全面完成DeepSeek本地部署

天津渤化集团全面完成DeepSeek本地部署

津滨网讯(记者 战旗)近日,天津渤海化工集团有限责任公司(以下简称“集团”)在数字化转型征程中稳健迈进,成功完成了DeepSeek大模型的本地部署,并引入了智能办公助手。这一举措旨在全方位提升生产效率...

DeepSeek要掀数据存储的“桌子”?

DeepSeek要掀数据存储的“桌子”?

最近这几天,业界关注度最高的无疑是DeepSeek的几个开源项目,几乎每一个都会在该领域里带来一些惊喜。数据猿作为大数据领域的专业媒体,一直从数据层面来关注行业的进展。不得不说,在算法和算力层面很热闹...

DeepSeek:像聊天一样清洗数据,复杂操作变简单

DeepSeek:像聊天一样清洗数据,复杂操作变简单

在日常工作中,你是否经常遇到这样的烦恼:表格数据杂乱无章,需要手动拆分单元格到不同行;二维交叉表难以分析,想转成一维表却无从下手;分组汇总时,想把多行合并成一行,但耗时费力……别焦虑!用DeepSee...