当前位置:首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练

1年前 (2025-03-26)DeepSeek技术交流582

明敏 发自 凹非寺

量子位 | 公众号 QbitAI

刚刚,DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5!

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B,与此前网传的685B有所出入。

开源版本上下文长度为128K(网页端、App和API提供 64K 上下文)。

私有化部署时只需要更新checkpoint和tokenizer_config.json(tool calls相关变动)。

目前,想要体验这一版本模型,只需用户登录官方网页、APP、小程序进入对话界面后,关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议,此后非复杂推理任务使用V3新版本更好。

此外,官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高,视觉效果也更好。

中文写作

相较于R1版有进一步优化,特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文:

中文搜索

联网情况下,V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy(上下滑动查看完整内容):

此外,V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力,比如做个小游戏:

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说,趁着深夜,还没睡的赶紧去体验最新版吧~


原标题:《新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练》


“新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练” 的相关文章

华厦眼科布局DeepSeek:以智能化转型驱动创新,迸发增长潜力

华厦眼科布局DeepSeek:以智能化转型驱动创新,迸发增长潜力

3月5日,华厦眼科DeepSeek模型本地化部署暨AI创新平台启动仪式盛大举行,标志着华厦眼科在人工智能与眼科医疗融合上迈出了重要一步,正式进入“AI协同守护全生命周期眼健康”的智慧医疗新时代!厦门大...

从“学术助手”到“吐槽利器 ” 高校学生掀起DeepSeek另类应用

从“学术助手”到“吐槽利器 ” 高校学生掀起DeepSeek另类应用

《科创板日报》2月16日讯(实习记者 姚桐 记者 毛明江)近日,国内多所高校学生群体中掀起一股使用DeepSeek“锐评”母校及学科专业的热潮。为何年轻人选择用AI工具表达对教育体系的看法?背后折射出...

大火、环保、核电与DeepSeek,欧洲对AI追赶之道的思考

大火、环保、核电与DeepSeek,欧洲对AI追赶之道的思考

这是2月10日在法国巴黎大皇宫拍摄的人工智能行动峰会现场。新华社 图巴黎的大皇宫,是法国为了1900年的世博会而专门修建的。当时的法国,还处在美好年代的顶峰,是数一数二的世界强国,也是科技大国。一百多...

DeepSeek“牵手”政务服务,人工服务何去何从

DeepSeek“牵手”政务服务,人工服务何去何从

当前,全球正迎来新一轮科技革命和产业变革的浪潮,在这场波澜壮阔的变革中,人工智能技术犹如一颗璀璨的新星,闪耀着夺目的光芒。以DeepSeek为代表的人工智能大模型,凭借其强大的计算能力、精准的数据分析...

安徽率先落地DeepSeek满血版,打造“人工智能+政务服务”样板

安徽率先落地DeepSeek满血版,打造“人工智能+政务服务”样板

日前,安徽省率先在全国省级层面完成DeepSeek满血版(671B)本地化部署,推出无差别综窗、公文写作、语音转文字等16个典型应用,并在全省试用推广。“我们已在‘皖政通’推出‘语音转文字’应用,利用...

宸展光电:目前研发的新产品可接入DeepSeek

宸展光电:目前研发的新产品可接入DeepSeek

证券日报网讯 5月7日,宸展光电在投资者互动交流平台上,针对投资者关于DeepSeek技术应用的相关提问,给出了专业且审慎的回应。有投资者关心宸展光电产品接入DeepSeek技术所需的硬件条件,公司明...