当前位置:首页 > Deepseek最新资讯 > 正文内容

最新的DeepSeek更新了 有网友对新版R1模型进行了测试

2个月前 (05-29)Deepseek最新资讯265

5月28日,DeepSeek在官方交流群中公布,DeepSeek R1模型已完成小版本试升级。用户可在官方网页、APP、小程序测试(打开深度思考),API接口和使用方式保持不变。DeepSeek在开源社区Hugging Face也开源了新版R1模型(R1-0528)。

有网友对新版R1模型进行了测试,并表示Deepseek-R1-0528在竞赛级编程的难度基准LiveCodeBench中的表现几乎与OpenAI的o3模型相当。

社交网络和信息网站City-data.com创始人Lech Mazur在社交媒体上表示,Deepseek-R1-0528在Extended NYT Connections基准测试中比原先的DeepSeek R1有了显著改进,分数从38.6上升到49.8。在Thematic Generation基准测试中,Deepseek-R1-0528也优于DeepSeek R1,分数从1.80变为1.74,该分数越低越好。Thematic Generation基准测试衡量各种大模型如何有效地从一小组正例和反例中推断出一个细分或特定的“主题”(类别/规则),然后在一组具有误导性的候选项中检测出哪一项真正符合该主题。

DeepSeek今年春节期间大火。3月份,DeepSeek V3模型完成小版本升级。新版V3模型借鉴DeepSeek R1模型训练过程中所使用的强化学习技术,大幅提高了在推理类任务上的表现水平,在数学、代码类相关评测集上取得了超过GPT-4.5的得分成绩。在HTML等代码前端任务上,新版V3模型生成的代码可用性更高,视觉效果也更加美观、富有设计感。在中文写作任务方面,新版V3模型基于R1的写作水平进行优化,同时提升中长篇文本创作的内容质量。


“最新的DeepSeek更新了 有网友对新版R1模型进行了测试” 的相关文章

DeepSeek入场引发教育行业变革,中公教育抢占AI先机

DeepSeek入场引发教育行业变革,中公教育抢占AI先机

随着DeepSeek大模型的强势入场,教育行业正经历智能化转型的关键时刻。继ChatGPT之后,DeepSeek的加入为教育领域带来新一轮技术革命,头部机构纷纷布局"大模型+垂直场景&quo...

升级版DeepSeek-V3模型开源!DeepSeek上可试用体验

升级版DeepSeek-V3模型开源!DeepSeek上可试用体验

【TechWeb】3月25日消息,DeepSeek在开源平台上线了升级后的DeepSeek-V3模型。新模型的版本号为DeepSeek-V3-0324,模型参数为6850亿,其早期版本参数为6710亿...

搭载国内首个Deep Research功能,元知平台让用户零门槛免费用满血DeepSeek

搭载国内首个Deep Research功能,元知平台让用户零门槛免费用满血DeepSeek

未来式智能今天推出元知:让满血DeepSeek R1触手可及未来式智能作为国内领先的AI智能体构建平台,始终致力于通过前沿的AI技术,为10亿知识工作者提升10倍生产力为愿景。今天,未来式智能推出元知...

北京市监局通过百度智能云千帆接入DeepSeek

北京市监局通过百度智能云千帆接入DeepSeek

3月5日,据百度智能云消息,北京市市场监管局企业登记注册场景近日通过百度智能云千帆大模型平台接入DeepSeek大模型,实现企业登记注册业务24小时在线“智能咨询”服务。...

DeepSeek与财富管理:慧眼识机,决胜千里

DeepSeek与财富管理:慧眼识机,决胜千里

在数字化浪潮席卷各行各业的今天,传统的财富管理模式正面临前所未有的挑战。财富管理不仅需要处理大量复杂的信息和数据,还需面对市场波动的风险和客户需求的多样化。然而,随着人工智能技术的飞速发展,尤其是De...

中国石化完成全尺寸DeepSeek国产化部署

中国石化完成全尺寸DeepSeek国产化部署

2月14日,界面新闻从中国石化新闻办获悉,自国产深度推理大模型DeepSeek发布以来,中国石化组建了专门的模型部署和测评团队,2月5日完成DeepSeek在国产化算力环境上的部署,并接入长城大模型应...