当前位置:首页 > Deepseek最新资讯 > 正文内容

最新的DeepSeek更新了 有网友对新版R1模型进行了测试

5月28日,DeepSeek在官方交流群中公布,DeepSeek R1模型已完成小版本试升级。用户可在官方网页、APP、小程序测试(打开深度思考),API接口和使用方式保持不变。DeepSeek在开源社区Hugging Face也开源了新版R1模型(R1-0528)。

有网友对新版R1模型进行了测试,并表示Deepseek-R1-0528在竞赛级编程的难度基准LiveCodeBench中的表现几乎与OpenAI的o3模型相当。

社交网络和信息网站City-data.com创始人Lech Mazur在社交媒体上表示,Deepseek-R1-0528在Extended NYT Connections基准测试中比原先的DeepSeek R1有了显著改进,分数从38.6上升到49.8。在Thematic Generation基准测试中,Deepseek-R1-0528也优于DeepSeek R1,分数从1.80变为1.74,该分数越低越好。Thematic Generation基准测试衡量各种大模型如何有效地从一小组正例和反例中推断出一个细分或特定的“主题”(类别/规则),然后在一组具有误导性的候选项中检测出哪一项真正符合该主题。

DeepSeek今年春节期间大火。3月份,DeepSeek V3模型完成小版本升级。新版V3模型借鉴DeepSeek R1模型训练过程中所使用的强化学习技术,大幅提高了在推理类任务上的表现水平,在数学、代码类相关评测集上取得了超过GPT-4.5的得分成绩。在HTML等代码前端任务上,新版V3模型生成的代码可用性更高,视觉效果也更加美观、富有设计感。在中文写作任务方面,新版V3模型基于R1的写作水平进行优化,同时提升中长篇文本创作的内容质量。


“最新的DeepSeek更新了 有网友对新版R1模型进行了测试” 的相关文章

飞书低代码平台已全面接入Deepseek R1模型能力

飞书低代码平台已全面接入Deepseek R1模型能力

钛媒体App 2月14日消息,飞书低代码平台已全面接入Deepseek R1模型能力。平台提供大量AI增强能力,开发者可在流程中直接调用DeepSeekR1模型,对数据进行批量自动化处理。此外,页面中...

AI大模型预测“晋京大战”结果 DeepSeek分析山西男篮将会胜出

AI大模型预测“晋京大战”结果 DeepSeek分析山西男篮将会胜出

曾凡博是北京队当家球星。新华社 发张宁是山西男篮的本土核心之一。王韵菲 摄山西男篮13年后再次进入四强,半决赛的对手又是北京队,仿佛是老天特意的安排。2011-2012赛季半决赛中,北京队曾以总比分3...

梁文锋的秘密武器:DeepSeek R2或5月问世,成本仅GPT-4o的2.7%

梁文锋的秘密武器:DeepSeek R2或5月问世,成本仅GPT-4o的2.7%

五月将至,中美科技巨头或将迎来新一轮巅峰对决。先是在4月中旬,OpenAI一口气发布了GPT-4.1 o3、o4 mini系列模型;谷歌则拿出了Gemini 2.5 Flash Preview,一个混...

DeepSeek-V3模型悄然更新,编程数学能力更强了

DeepSeek-V3模型悄然更新,编程数学能力更强了

交汇点讯 3月24日晚间,deepseek 悄然发布一款新的大语言模型——deepseek-v3-0324。这款 641gb 大小的模型在开源平台hugging face上亮相,几乎未作任何宣传。本次...

李开复:DeepSeek将中美AI差距缩小至3个月

李开复:DeepSeek将中美AI差距缩小至3个月

参考消息网3月25日报道据新加坡《联合早报》网站3月25日报道,中国初创企业零一万物首席执行官李开复说,在人工智能(AI)发展方面,中国已将与美国在某些领域的差距缩小至仅3个月,因为中国初创企业深度求...

荣耀AI搜索官宣接入DeepSeek联网版

荣耀AI搜索官宣接入DeepSeek联网版

2月21日晚间,荣耀终端宣布,荣耀AI搜索接入DeepSeek联网版,将陆续覆盖更多手机机型。荣耀方面介绍,即日起,DeepSeek-R1联网版将覆盖荣耀手机MagicOS 8.0及以上,以及YOYO...