当前位置：首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练

8个月前 (03-26)DeepSeek技术交流439

明敏发自凹非寺

量子位 | 公众号 QbitAI

刚刚，DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5！

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B，与此前网传的685B有所出入。

开源版本上下文长度为128K（网页端、App和API提供 64K 上下文）。

私有化部署时只需要更新checkpoint和tokenizer_config.json（tool calls相关变动）。

目前，想要体验这一版本模型，只需用户登录官方网页、APP、小程序进入对话界面后，关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议，此后非复杂推理任务使用V3新版本更好。

此外，官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高，视觉效果也更好。

中文写作

相较于R1版有进一步优化，特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文：

中文搜索

联网情况下，V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy（上下滑动查看完整内容）：

此外，V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力，比如做个小游戏：

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说，趁着深夜，还没睡的赶紧去体验最新版吧~

原标题：《新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练》

标签: DeepSeek 人工智能数据分析应用场景

返回列表

上一篇：DeepSeek V3再次震撼硅谷，中美AI差距突然缩至3个月！

下一篇：DeepSeek-V3升级：评测达75.9%正确率，代码生成提速40%

“新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练” 的相关文章

机构调研券商！DeepSeek部署成为热点问题

券商股近期异动频频。券商中国记者注意到，对于上市券商的关注，除了一些合并传闻的扰动，机构投资者对长江证券、长城证券等上市券商以及券商概念股——指南针等，也展开了新一轮调研，券商布局DeepSeek的进...

打工人自救指南：3招驯服DeepSeek，变身你的24小时秘书

被工作逼疯？AI 时代还手动搬砖，你就输啦！凌晨两点半，城市早已沉睡，你的办公室却灯火通明。屏幕的光照在脸上，映出疲惫不堪的神情。Excel 里八百多条数据等待分类标红，PPT 的柱状图莫名出错，钉钉...

DeepSeek如何保障患者信息安全？

DeepSeek如何保障患者信息安全？思考和行动过程用户希望了解DeepSeek在保障患者信息安全方面的具体措施。DeepSeek是一款开源的人工智能模型，被应用于医疗诊断等多个领域，处理大量敏感的患...

EasyStack+DeepSeek渐进式构建可进化的AI基础设施

当大模型从技术奇点向产业纵深演进，企业正面临AI基础设施的多重挑战：既要通过私有化部署满足数据隐私和安全需求，又要承载百亿、千亿参数规模的澎湃算力；既要应对动态演进的业务需求，又要平衡基础设施的投入成...

DeepSeek“崩上热搜”，官网回应：APP、WEB对话功能已恢复正常

DeepSeek今日（5月13日）登上微博热搜，不少网友反馈一直在转圈、无法使用。晚间，DeepSeek服务状态页面更新称，APP、WEB对话功能恢复正常，对话历史有概率获取失败。...

Deepseek App自上线以来累计下载量超1.1亿次 API调用价格下调普通用户使用DeepSeek免费

Deepseek App自上线以来累计下载量超1.1亿次 API调用价格下调普通用户使用DeepSeek免费2月26日晚间，国产AI大模型DeepSeek在官微宣布，推出错峰优惠活动，北京时间每日00...