当前位置:首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练

1年前 (2025-03-26)DeepSeek技术交流591

明敏 发自 凹非寺

量子位 | 公众号 QbitAI

刚刚,DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5!

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B,与此前网传的685B有所出入。

开源版本上下文长度为128K(网页端、App和API提供 64K 上下文)。

私有化部署时只需要更新checkpoint和tokenizer_config.json(tool calls相关变动)。

目前,想要体验这一版本模型,只需用户登录官方网页、APP、小程序进入对话界面后,关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议,此后非复杂推理任务使用V3新版本更好。

此外,官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高,视觉效果也更好。

中文写作

相较于R1版有进一步优化,特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文:

中文搜索

联网情况下,V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy(上下滑动查看完整内容):

此外,V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力,比如做个小游戏:

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说,趁着深夜,还没睡的赶紧去体验最新版吧~


原标题:《新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练》


“新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练” 的相关文章

华为云广东DeepSeek思享会·珠海站成功举办——共话AI浪潮下行业深度应用新路径

华为云广东DeepSeek思享会·珠海站成功举办——共话AI浪潮下行业深度应用新路径

当下,人工智能技术日新月异,对各行业的渗透与变革正以前所未有的速度展开,成为推动经济发展和社会进步的关键力量。今年年初DeepSeek爆火,以其独特的技术优势和创新能力,受到了社会各界高度关注。为了进...

企业微信+DeepSeek来了-企业微信接入DeepSeek

企业微信+DeepSeek来了-企业微信接入DeepSeek

【企业微信接入DeepSeek】《科创板日报》21日讯,今日,企业微信发布新版本,灰度接入满血版DeepSeek-R1大模型,正式发布"智能机器人"、"智能表格-客户跟进...

DeepSeek怎么提问才能让它回答的更全?

DeepSeek怎么提问才能让它回答的更全?

万能句式:是什么+为什么+怎么做+提要求(如果问题太多,可以拆分成多个小问题提问,打开“深度思考”提问问题会有逻辑连贯) 据说AI是未来发展的趋势,那我肯定得好好学一下DeepSeek。作为刚上...

数坤科技、华为联手!助力深圳市人民医院完成DeepSeek本地化部署

数坤科技、华为联手!助力深圳市人民医院完成DeepSeek本地化部署

近日,深圳市人民医院、数坤科技与华为三方达成深度合作,实现了DeepSeek-R1模型及“数坤坤”多模态医疗健康大模型的院内部署,并共同打造基于医疗专业大模型的数智医院建设整体解决方案,将为医院的医疗...

辽宁省高校“昇腾AI+DeepSeek:重构高校教育科技生态”研讨会在沈阳成功举办

辽宁省高校“昇腾AI+DeepSeek:重构高校教育科技生态”研讨会在沈阳成功举办

近日,辽宁省高校“昇腾AI+DeepSeek:重构高校教育科技生态”研讨会在沈阳成功举办。本次会议以“AI赋能教育教学”为主题,探讨“昇腾AI重构高校教育科技生态”,探索新时代高校数智化发展新模式,推...

央国企上线DeepSeek “算力+AI”赋能工业发展

央国企上线DeepSeek “算力+AI”赋能工业发展

自2025年春节以来,DeepSeek的全新开源推理模型在全球范围内迅速走红,成为各界关注的焦点,同时引发国产AI发展浪潮。众多国内企业相继接入DeepSeek系列模型,以提升企业智能化水平,加速业务...