当前位置:首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练

1年前 (2025-03-26)DeepSeek技术交流603

明敏 发自 凹非寺

量子位 | 公众号 QbitAI

刚刚,DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5!

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B,与此前网传的685B有所出入。

开源版本上下文长度为128K(网页端、App和API提供 64K 上下文)。

私有化部署时只需要更新checkpoint和tokenizer_config.json(tool calls相关变动)。

目前,想要体验这一版本模型,只需用户登录官方网页、APP、小程序进入对话界面后,关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议,此后非复杂推理任务使用V3新版本更好。

此外,官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高,视觉效果也更好。

中文写作

相较于R1版有进一步优化,特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文:

中文搜索

联网情况下,V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy(上下滑动查看完整内容):

此外,V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力,比如做个小游戏:

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说,趁着深夜,还没睡的赶紧去体验最新版吧~


原标题:《新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练》


“新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练” 的相关文章

创新驱动 智领未来 山东移动DeepSeek高教共创沙龙举办

创新驱动 智领未来 山东移动DeepSeek高教共创沙龙举办

在科技飞速发展的当下,人工智能技术正以前所未有的速度重塑高等教育发展格局。为深入探索人工智能与高等教育的融合创新路径,3月27日,山东移动携手华为在青岛举办以“创新驱动 智领未来”为主题的DeepSe...

绿联NAS+Deepseek的新玩法:本地化部署与AI创新

绿联NAS+Deepseek的新玩法:本地化部署与AI创新

在AI技术加速落地的2025年,绿联NAS产品线也在进行全面AI化升级,无论是年初在2025 CES展上发布全球首款内置大型语言模型(LLM)的AI NAS iDX6011系列,还是近期推出了一系列基...

DeepSeek全球时刻,全球南方有望破“智能鸿沟”

DeepSeek全球时刻,全球南方有望破“智能鸿沟”

【导读】4月26日,全球南方系列十讲的第二讲“数字技术在全球南方的开源与共享”,在华东师范大学普陀校区举办。华东师范大学政治与国际关系学院教授余南平做主讲,并在圆桌环节与华东师范大学上海人工智能金融学...

Deepseek引发AI+变革浪潮 2025年AI行情可期

Deepseek引发AI+变革浪潮 2025年AI行情可期

本报记者 顾梦轩 夏欣 广州、北京报道2025年新年伊始,中国AI企业深度求索(DeepSeek)的开源大模型DeepSeek-R1在资本市场掀起巨浪。Wind数据显示,截至2月12日,万得Deeps...

微信回应“接入DeepSeek”:不会使用用户朋友圈、聊天记录

微信回应“接入DeepSeek”:不会使用用户朋友圈、聊天记录

日前,微信宣布接入DeepSeek-R1模型,目前为灰度测试阶段,部分用户在微信搜索框选择AI搜索,可使用DeepSeek-R1的深度思考功能。消息一出,引发网友热议,随后微信发文回应几个疑问:微信A...

信安世纪:已完成包括DeepSeek在内的主流大模型本地化部署

信安世纪:已完成包括DeepSeek在内的主流大模型本地化部署

每经AI快讯,信安世纪(688201)2月28日在互动平台表示,公司已经完成包括DeepSeek在内的主流大模型本地化部署,正在进行相关产品的对接接入工作,今年暂无推出DeepSeek一体机计划。...