当前位置:首页 > Deepseek最新资讯 > 正文内容

最新的DeepSeek更新了 有网友对新版R1模型进行了测试

3个月前 (05-29)Deepseek最新资讯413

5月28日,DeepSeek在官方交流群中公布,DeepSeek R1模型已完成小版本试升级。用户可在官方网页、APP、小程序测试(打开深度思考),API接口和使用方式保持不变。DeepSeek在开源社区Hugging Face也开源了新版R1模型(R1-0528)。

有网友对新版R1模型进行了测试,并表示Deepseek-R1-0528在竞赛级编程的难度基准LiveCodeBench中的表现几乎与OpenAI的o3模型相当。

社交网络和信息网站City-data.com创始人Lech Mazur在社交媒体上表示,Deepseek-R1-0528在Extended NYT Connections基准测试中比原先的DeepSeek R1有了显著改进,分数从38.6上升到49.8。在Thematic Generation基准测试中,Deepseek-R1-0528也优于DeepSeek R1,分数从1.80变为1.74,该分数越低越好。Thematic Generation基准测试衡量各种大模型如何有效地从一小组正例和反例中推断出一个细分或特定的“主题”(类别/规则),然后在一组具有误导性的候选项中检测出哪一项真正符合该主题。

DeepSeek今年春节期间大火。3月份,DeepSeek V3模型完成小版本升级。新版V3模型借鉴DeepSeek R1模型训练过程中所使用的强化学习技术,大幅提高了在推理类任务上的表现水平,在数学、代码类相关评测集上取得了超过GPT-4.5的得分成绩。在HTML等代码前端任务上,新版V3模型生成的代码可用性更高,视觉效果也更加美观、富有设计感。在中文写作任务方面,新版V3模型基于R1的写作水平进行优化,同时提升中长篇文本创作的内容质量。


“最新的DeepSeek更新了 有网友对新版R1模型进行了测试” 的相关文章

神州信息引入国产开源大模型DeepSeek

神州信息引入国产开源大模型DeepSeek

36氪获悉,神州信息最新引入国产开源大模型DeepSeek,实现对全栈金融解决方案的智能化迭代升级,通过低成本、高安全的私域环境部署,帮助银行客户快速获得大模型的各项能力,全面加速银行智能化发展。通过...

DeepSeek对未来就业有何影响?

DeepSeek对未来就业有何影响?

据新民晚报报道:2月17日上午,民营企业座谈会在首都北京召开。参与此次座谈会的民营企业代表包括华为创始人任正非、DeepSeek创始人梁文锋、腾讯创始人马化腾、宇树科技创始人王兴兴、比亚迪创始人王传福...

浅谈DeepSeek对于数据分析师的赋能

浅谈DeepSeek对于数据分析师的赋能

在数据驱动决策的时代,效率就是生产力。DeepSeek作为AI助手,如何帮助数据分析师解放双手、提升10-100倍效率?本文带你深入了解这一革命性工具。引言数据分析师的日常是什么?清洗数据、探索关系、...

中电万维助力兰州政务系统接入DeepSeek 打造“小兰AI答”

中电万维助力兰州政务系统接入DeepSeek 打造“小兰AI答”

2月24日,中电万维应兰州市数据局要求,将DeepSeek人工智能大模型接入兰州市政府门户网站,打造DeepSeek在兰州市的首个应用场景。万维迅速组建DeepSeek专项协同攻坚队,55小时内圆满完...

炮制假网站、虚假宣传诱导购买AI课程 有不法分子披着DeepSeek外衣行骗

炮制假网站、虚假宣传诱导购买AI课程 有不法分子披着DeepSeek外衣行骗

本报讯 (记者姜雨晴)“页面制作得太逼真了!”3月31日,四川的菲菲告诉记者,日前她在网页搜索知名科技公司DeepSeek网站时,被诱导付费后才发现误入钓鱼网站陷阱。经过长时间的申诉,对方最终迫于监管...

科蓝软件:公司已将DeepSeek-R1模型整合至公司的人工智能应用平台-魔聚平台

科蓝软件:公司已将DeepSeek-R1模型整合至公司的人工智能应用平台-魔聚平台

每经AI快讯,有投资者在投资者互动平台提问:请问董秘,公司是否接qudeepseek,有没有接入的计划。科蓝软件(300663.SZ)3月5日在投资者互动平台表示,公司已成功将DeepSeek-R1...