当前位置:首页 > DeepSeek技术交流 > 正文内容

全国高校首个!东南大学继DeepSeek又上线QwQ-32B

6个月前 (03-09)DeepSeek技术交流417

本文转自【新华日报】;

近日

东大基于昇腾国产算力平台

正式接入阿里最新开源模型QwQ-32B

成为全国首个上线QwQ-32B服务的高校

国产算力基座+头部大模型双轨融合

将为教学科研注入更强的AI动能

QwQ-32B:DeepSeek-R1的超强平替

性能比肩顶级模型

QwQ-32B虽仅有32B参数,但通过大规模强化学习训练,在数学推理(AIME24评测)、代码生成(LiveCodeBench)、工具调用(BFCL测试)等任务中表现媲美671B参数的DeepSeek-R1,甚至部分指标实现超越。

上图展示了 QwQ-32B 与其他领先模型在数学推理(AIME24评测)、代码生成(LiveCodeBench)、工具调用(BFCL测试)中的性能对比,QwQ-32B 表现与 DeepSeek-R1 相当,远胜于 o1-mini 及相同尺寸的 R1 蒸馏模型。

低成本、易部署

模型支持消费级显卡本地部署,大幅降低硬件门槛,适配昇腾平台的高效算力资源,助力师生在科研中快速实现AI推理需求。

智能体能力革新

集成工具调用与动态推理能力,模型可根据环境反馈调整策略,适用于复杂任务处理,如数据分析、实验模拟等科研场景。

来源:东南大学微信公众号


“全国高校首个!东南大学继DeepSeek又上线QwQ-32B” 的相关文章

DeepSeek全球时刻,全球南方有望破“智能鸿沟”

DeepSeek全球时刻,全球南方有望破“智能鸿沟”

【导读】4月26日,全球南方系列十讲的第二讲“数字技术在全球南方的开源与共享”,在华东师范大学普陀校区举办。华东师范大学政治与国际关系学院教授余南平做主讲,并在圆桌环节与华东师范大学上海人工智能金融学...

DeepSeek开源放大招:FlashMLA让H800算力狂飙!曝光低成本秘笈

DeepSeek开源放大招:FlashMLA让H800算力狂飙!曝光低成本秘笈

【新智元导读】DeepSeek开源周第一天就放大招!FlashMLA强势登场,这是专为英伟达Hopper GPU打造MLA解码内核。注意,DeepSeek训练成本极低的两大关键,一个是MoE,另一个就...

安卓首家接入DeepSeek背后:看见女性力量

安卓首家接入DeepSeek背后:看见女性力量

在人类社会的历史进程中,女性的力量从来不容小觑,她们以不同的方式在各个领域诠释着自身价值。今天,我们将目光投向科技领域:中国科技部最新统计显示,我国女性科技工作者总量达4260万人,在科研人员总量中占...

百度的后DeepSeek时代,一切为了应用

百度的后DeepSeek时代,一切为了应用

“模型有很多,但统治这个世界的是应用”,百度创始人李彦宏更直白地表达了对应用的重视。近日召开的Create2025百度AI开发者大会上,百度一口气发布了从模型到应用、生态的“九件套”,包括性能提升价格...

全市首家!南岸医保牵手DeepSeek 服务与政策智能触达

全市首家!南岸医保牵手DeepSeek 服务与政策智能触达

5月22日,基于DeepSeek大模型,结合微信公众号服务,医保服务事项和业务办理流程等内容,南岸区医疗保障局全新升级的医保智能客服——“医保智慧助手”投入试运行。这标志着重庆市首个接入DeepSee...

所有人都在接入DeepSeek,自研大模型还有必要吗?

所有人都在接入DeepSeek,自研大模型还有必要吗?

最近这一段时间,无论是谁都必须要承认一个现实,这就是DeepSeek彻底火遍了全网,这个国产大模型所带来的冲击一点都不比当时ChatGpt推出的时候差,一时间几乎所有人都在接入DeepSeek,似乎如...