当前位置:首页 > DeepSeek技术交流 > 正文内容

DeepSeek V3升级版发布:编程数学能力接近Claude 3.7

1年前 (2025-03-25)DeepSeek技术交流626

DeepSeek于24日夜间发布V3模型小版本升级,新版本DeepSeek-V3-0324在模型参数上达到685B,并采用MIT许可证,为用户带来全新体验。该版本重点提升了数学和编程能力,性能接近Claude 3.7 Sonnet,且对用户免费开放使用。

模型架构全面升级

DeepSeek-V3作为专家混合巨头模型,原始参数为671B,每个Token可激活370亿个参数。新版本DeepSeek-V3-0324的模型参数提升至685B,采用多头潜在注意力和DeepSeek MoE技术支持。知识截止日期从2023年12月延长至2024年7月,优化了Function call功能,解决了此前版本的函数调用问题。

编程能力显著提升

在前端编程领域,DeepSeek V3-0324展现出惊人实力。测试显示,其能在3分钟内完成750行电商网站代码,包含动态产品卡片悬停效果和手机端响应式布局等功能。自2024年6月以来,业界普遍认为仅Claude 3.5能够生成优质前端代码,而此次DeepSeek的升级版本终于为Anthropic带来了强劲竞争对手。在数学能力方面,V3-0324也表现出色,成功解答了此前大模型普遍解答错误的数学题目。

开源协议引领行业变革

DeepSeek V3-0324采用MIT许可证,允许用户出于任何目的使用、修改和分发模型,包括商业用途。这一决策获得业内广泛关注,Perplexity CEO阿拉文德认为,DeepSeek的开源策略具有革命性意义。该模型不仅能在AWS和Azure上以极低成本部署,仅需支付服务器费用,还为创业企业提供了可负担的AI解决方案。这种开源模式可能影响未来AI巨头的融资格局,推动行业向更开放、更透明的方向发展。

本文源自:金融界


“DeepSeek V3升级版发布:编程数学能力接近Claude 3.7” 的相关文章

西宁市12345热线搭载DeepSeek大模型应用

西宁市12345热线搭载DeepSeek大模型应用

3月1日,记者从中国移动通信集团青海有限公司西宁分公司(以下简称西宁移动)获悉,西宁市12345热线平台正式搭载DeepSeek大模型应用后,通过一周测试数据分析,预计接通率和准确率将分别提升7%、1...

AI观察|模型私有化部署量一季度翻倍增长,中国SaaS企业迎来春天

AI观察|模型私有化部署量一季度翻倍增长,中国SaaS企业迎来春天

DeepSeek的出圈一扫中国AI市场的阴霾,在刚刚结束的2025年第一季度,长久以来在市场上苦苦挣扎的SaaS((Software as a Service)企业迎来了春天。DeepSeek让中国各...

拥抱人工智能 DeepSeek应用专题培训会成功举办

拥抱人工智能 DeepSeek应用专题培训会成功举办

3月18日下午,由滨海新区区委区级机关工委、区委网信办、区数据局共同主办,区级机关工会联合会承办的DeepSeek应用专题培训会召开。培训聚焦“人工智能领域前沿技术的认知与DeepSeek操作应用能力...

梁文锋参与发表回顾性论文:DeepSeek首次揭秘V3模型背后扩展方案

梁文锋参与发表回顾性论文:DeepSeek首次揭秘V3模型背后扩展方案

DeepSeek刚刚发表了一篇名为《深入解读 DeepSeek-V3:AI 架构的扩展挑战与硬件思考》(Insights into DeepSeek-V3: Scaling Challenges an...

让deepseek写文章的技巧?如何使用deepseek写作?deepseek可以做海报吗?

让deepseek写文章的技巧?如何使用deepseek写作?deepseek可以做海报吗?

一、让DeepSeek写文章的技巧精准角色设定复制代码“请扮演《经济学人》专栏作家,分析全球碳中和政策对制造业的影响,要求:学术严谨但避免术语堆砌,引用至少2个2025年最新案例。”结构化框架引导复制...

轻松健康集团接入DeepSeek

轻松健康集团接入DeepSeek

36氪获悉,轻松健康集团日前宣布完成与DeepSeek的技术整合。此次升级标志着轻松健康集团在医疗AI领域的技术储备已形成"算法层-应用层-商业层"的三重壁垒,其自主研发的AIca...