当前位置:首页 > Deepseek最新资讯 > 正文内容

最新的DeepSeek更新了 有网友对新版R1模型进行了测试

1年前 (2025-05-29)Deepseek最新资讯747

5月28日,DeepSeek在官方交流群中公布,DeepSeek R1模型已完成小版本试升级。用户可在官方网页、APP、小程序测试(打开深度思考),API接口和使用方式保持不变。DeepSeek在开源社区Hugging Face也开源了新版R1模型(R1-0528)。

有网友对新版R1模型进行了测试,并表示Deepseek-R1-0528在竞赛级编程的难度基准LiveCodeBench中的表现几乎与OpenAI的o3模型相当。

社交网络和信息网站City-data.com创始人Lech Mazur在社交媒体上表示,Deepseek-R1-0528在Extended NYT Connections基准测试中比原先的DeepSeek R1有了显著改进,分数从38.6上升到49.8。在Thematic Generation基准测试中,Deepseek-R1-0528也优于DeepSeek R1,分数从1.80变为1.74,该分数越低越好。Thematic Generation基准测试衡量各种大模型如何有效地从一小组正例和反例中推断出一个细分或特定的“主题”(类别/规则),然后在一组具有误导性的候选项中检测出哪一项真正符合该主题。

DeepSeek今年春节期间大火。3月份,DeepSeek V3模型完成小版本升级。新版V3模型借鉴DeepSeek R1模型训练过程中所使用的强化学习技术,大幅提高了在推理类任务上的表现水平,在数学、代码类相关评测集上取得了超过GPT-4.5的得分成绩。在HTML等代码前端任务上,新版V3模型生成的代码可用性更高,视觉效果也更加美观、富有设计感。在中文写作任务方面,新版V3模型基于R1的写作水平进行优化,同时提升中长篇文本创作的内容质量。


“最新的DeepSeek更新了 有网友对新版R1模型进行了测试” 的相关文章

江西联通深化人工智能赋能 推动DeepSeek多领域融合创新

江西联通深化人工智能赋能 推动DeepSeek多领域融合创新

当下最热的DeepSeek与江西联通携手,将擦出怎样的精彩火花?从政务服务到高校课堂,从纺织车间到产业决策,一场由人工智能驱动的变革正加速重构传统业态。近日,江西联通以DeepSeek大模型为核心,在...

DeepSeek,重磅突发!DeepSeek官宣,今日开源代码库为DeepEP

DeepSeek,重磅突发!DeepSeek官宣,今日开源代码库为DeepEP

2月25日,DeepSeek官宣,今日开源代码库为DeepEP,它是首个用于 MoE 模型训练和推理的开源EP通信库。特点有:高效的全员沟通;节点内和节点间均支持 NVLink和RDMA;用于训练和推...

实达集团完成对DeepSeek-R1应用的部署

实达集团完成对DeepSeek-R1应用的部署

实达集团完成对DeepSeek-R1应用的部署每经AI快讯,有投资者在投资者互动平台提问:请问贵公司是否已经部署了DeepSeek?如果已经部署了,请问主要应用于哪些具体的业务?公司接入DeepSee...

华为云广东DeepSeek思享会·珠海站成功举办——共话AI浪潮下行业深度应用新路径

华为云广东DeepSeek思享会·珠海站成功举办——共话AI浪潮下行业深度应用新路径

当下,人工智能技术日新月异,对各行业的渗透与变革正以前所未有的速度展开,成为推动经济发展和社会进步的关键力量。今年年初DeepSeek爆火,以其独特的技术优势和创新能力,受到了社会各界高度关注。为了进...

九号公司:九号出行APP已率先完成DeepSeek-R1的接入

九号公司:九号出行APP已率先完成DeepSeek-R1的接入

每经AI快讯,有投资者在投资者互动平台提问:请问下我们公司是否有将deepseek嵌入到相关产品中,发挥产品更大的功能?九号公司(689009.SH)4月22日在投资者互动平台表示,2025年2月14...

美国银行证券分析师:DeepSeek或将加速中国车企开发自动驾驶技术

美国银行证券分析师:DeepSeek或将加速中国车企开发自动驾驶技术

IT之家 2 月 17 日消息,美国银行证券公司的分析师在一份研究报告中指出,DeepSeek 可能会加速中国汽车制造商开发自动驾驶方面的技术。该机构提出,DeepSeek 的开发逻辑与自动驾驶存在相...