当前位置:首页 > DeepSeek技术交流 > 正文内容

外界热议:DeepSeek又变强了!

7个月前 (03-27)DeepSeek技术交流484

中国人工智能初创公司深度求索(DeepSeek)24日深夜低调上线了DeepSeek-V3的新版本DeepSeek-V3-0324,参数量为6850亿,在代码、数学、推理等多个方面的能力再次显著提升,甚至代码能力追平美国Anthropic公司大模型Claude 3.7。

不过,外界对于DeepSeek-V3-0324的关注并不仅仅因为该版本的能力提升,而是猜测它的发布是否意味着DeepSeek更新一代的V4与R2大模型的发布不远了。

在回答《环球时报》记者有关DeepSeek-V3新版本有哪些能力提升时,DeepSeek表示,一是新版本代码能力显著提升,接近Claude 3.7水平。例如,有用户在实测中发现,V3-0324能一次性生成800行无错误的网页代码,并实现动态响应式布局和交互效果。二是数学与逻辑推理能力增强。例如经典的“4升水壶问题”和数学竞赛题(如AIME 2025题目),部分表现接近专业推理模型。三是模型架构与开源生态。V3-0324采用MIT许可证,允许自由修改、分发及商业化应用,进一步降低了开发者的使用门槛。

清华大学新闻学院、人工智能学院教授沈阳25日对《环球时报》记者表示,DeepSeek-V3-0324不仅是V3系列的一次迭代,更是中国AI技术崛起的又一力证。其在性能、效率和开源策略上的综合优势使其在全球大语言模型领域占据重要地位。未来,DeepSeek可能通过推理能力提升和多模态扩展来巩固技术领先优势,同时在中美竞争和社区生态中寻找平衡。沈阳认为,DeepSeek-V3-0324的发布看似是一次“小更新”,但其性能跳跃表明该团队可能在为后续重大版本(如传言中的DeepSeek-R2或V4)铺路。

路透社今年2月底引述3名知情人士的说法宣称,DeepSeek原计划在今年5月初发布R2,但现在希望尽早推出,具体时间尚未透露。此外,DeepSeek希望新模型在代码生成和多语言推理方面的表现进一步提升。不过,外媒的相关传言并没有得到DeepSeek公司的证实与回应。


沈阳表示,DeepSeek-V3-0324的推出进一步凸显中国AI企业在技术与成本上的竞争力。美国对华GPU出口限制可能促使中国企业加速国产硬件适配,同时其开源模式或引发西方厂商的连锁动作,例如推出更强闭源模型。2025年可能是中美AI竞争的分水岭。

沈阳认为,在OpenAI公司的GPT大模型要把通用大模型和推理大模型融合在一起的背景下,外界关注包括DeepSeek在内的中国头部大模型是不是最终也会出现这种合并的趋势。“这种可能是存在的,因为对于用户来说,并不关心大模型在回应自身问题时用的是什么类型的模型,更关心大模型能不能给出更为智能、合理的参考答案。”

(来源:环球时报)


“外界热议:DeepSeek又变强了!” 的相关文章

潮评丨“DeepSeek首次用于地震国际救援”,带给我们三重启示

潮评丨“DeepSeek首次用于地震国际救援”,带给我们三重启示

潮新闻客户端 评论员 王彬图源:央视新闻今天,话题#DeepSeek7小时攻克缅甸救灾语言关#登上热搜榜,引发网友关注。咋回事呢?近日发生的缅甸7.9级地震,灾情牵动人心。在救援行动中,一项由中国团队...

鸿合科技(002955.SZ):目前平台已接入DeepSeek开源大模型,并且应用在高职教产品和AI课堂分析

鸿合科技(002955.SZ):目前平台已接入DeepSeek开源大模型,并且应用在高职教产品和AI课堂分析

格隆汇4月9日丨鸿合科技(002955.SZ)在投资者互动平台表示,公司自主研发AI应用开放平台,并积极推动AI技术在教育场景的应用。目前平台已接入DeepSeek开源大模型,并且应用在高职教产品和A...

太平资产完成DeepSeek本地化部署

太平资产完成DeepSeek本地化部署

上证报中国证券网讯(记者 何奎)记者近日获悉,太平资产积极响应国家科技创新战略,顺应人工智能时代潮流,成功完成DeepSeek-R1大模型本地化部署,并实现国产化适配。据介绍,通过本地化部署DeepS...

数据安全又合规 京东云DeepSeek一体机助力金融机构快速用上大模型

数据安全又合规 京东云DeepSeek一体机助力金融机构快速用上大模型

随着金融科技的迅猛发展,越来越多的金融机构开始探索如何利用人工智能和大数据技术提升业务效率和服务质量。在这一背景下,京东云推出的DeepSeek一体机成为了众多金融机构的首选工具。它不仅能在保障数据安...

微信回应“接入DeepSeek”:不会使用用户朋友圈、聊天记录

微信回应“接入DeepSeek”:不会使用用户朋友圈、聊天记录

日前,微信宣布接入DeepSeek-R1模型,目前为灰度测试阶段,部分用户在微信搜索框选择AI搜索,可使用DeepSeek-R1的深度思考功能。消息一出,引发网友热议,随后微信发文回应几个疑问:微信A...

DeepSeek大模型技术落地江汉区 AI赋能智慧政务

DeepSeek大模型技术落地江汉区 AI赋能智慧政务

荆楚网(湖北日报网)讯(通讯员 王硕)在数字经济与实体经济深度融合的今天,人工智能正深刻重塑政务服务模式。今年以来,武汉市江汉区率先引入DeepSeek大模型技术,在重大项目监管、民生需求匹配、政策资...