当前位置:首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练

7个月前 (03-26)DeepSeek技术交流434

明敏 发自 凹非寺

量子位 | 公众号 QbitAI

刚刚,DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5!

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B,与此前网传的685B有所出入。

开源版本上下文长度为128K(网页端、App和API提供 64K 上下文)。

私有化部署时只需要更新checkpoint和tokenizer_config.json(tool calls相关变动)。

目前,想要体验这一版本模型,只需用户登录官方网页、APP、小程序进入对话界面后,关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议,此后非复杂推理任务使用V3新版本更好。

此外,官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高,视觉效果也更好。

中文写作

相较于R1版有进一步优化,特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文:

中文搜索

联网情况下,V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy(上下滑动查看完整内容):

此外,V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力,比如做个小游戏:

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说,趁着深夜,还没睡的赶紧去体验最新版吧~


原标题:《新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练》


“新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练” 的相关文章

全省首个!九江DeepSeek生态环境大模型部署上线

全省首个!九江DeepSeek生态环境大模型部署上线

近日,九江市生态环境局正式部署上线DeepSeek-生态环境大模型,该模型是九江市首个部署上线的DeepSeek大模型,将为九江市乃至全省生态环境系统提供个性化、智能化的AI服务,标志着九江市在“AI...

武汉经开区上线DeepSeek版智算中心

武汉经开区上线DeepSeek版智算中心

湖北日报客户端讯( 通讯员郑奇悦、鲁仲月)国产开源大模型DeepSeek火速“出圈”,成为科技焦点。2月14日,记者从中国电子云武汉可信智算中心获悉,该中心已“牵手”DeepSeek,在武汉经开区算力...

中国电信云南公司:携手DeepSeek赋能数字云南建设再升级

中国电信云南公司:携手DeepSeek赋能数字云南建设再升级

近日,云南多地政务、教育领域迎来智能化升级新突破。中国电信云南公司携手DeepSeek,通过AI大模型本地化部署,在教育教学、基层社会治理、政务服务等领域打造了一批具有示范效应的创新案例,为推动行业数...

韩国:暂停DeepSeek下载

韩国:暂停DeepSeek下载

据韩联社17日报道,韩国政府当天表示,已经临时暂停基于中国人工智能企业深度求索(DeepSeek)大模型的应用程序在韩国的服务,理由是所谓的“数据收集担忧”。报道称,韩国个人信息保护委员会(PIPC)...

红塔证券:红塔证券已经成功上线DeepSeek-R1大模型

红塔证券:红塔证券已经成功上线DeepSeek-R1大模型

每经AI快讯,有投资者在投资者互动平台提问:长城证券002939智源AI中心已上线了大模型DeepSeek-R1与阿里Qwen2.5,公司员工可通过系统中的AI工具中心进行使用体验。请问贵公司未来也考...

除了接入DeepSeek,企业还能怎么用AI?

除了接入DeepSeek,企业还能怎么用AI?

拥抱AI,这几个字正在从口号变成具体动作。我们看到,从智能客服能快速精准地解答客户疑问,到智能投顾为投资者提供个性化的理财方案,再到AI 驱动的自动化生产线实现了生产过程的精准控制和质量优化。AI 的...