当前位置:首页 > DeepSeek技术交流 > 正文内容

外界热议:DeepSeek又变强了!

1年前 (2025-03-27)DeepSeek技术交流648

中国人工智能初创公司深度求索(DeepSeek)24日深夜低调上线了DeepSeek-V3的新版本DeepSeek-V3-0324,参数量为6850亿,在代码、数学、推理等多个方面的能力再次显著提升,甚至代码能力追平美国Anthropic公司大模型Claude 3.7。

不过,外界对于DeepSeek-V3-0324的关注并不仅仅因为该版本的能力提升,而是猜测它的发布是否意味着DeepSeek更新一代的V4与R2大模型的发布不远了。

在回答《环球时报》记者有关DeepSeek-V3新版本有哪些能力提升时,DeepSeek表示,一是新版本代码能力显著提升,接近Claude 3.7水平。例如,有用户在实测中发现,V3-0324能一次性生成800行无错误的网页代码,并实现动态响应式布局和交互效果。二是数学与逻辑推理能力增强。例如经典的“4升水壶问题”和数学竞赛题(如AIME 2025题目),部分表现接近专业推理模型。三是模型架构与开源生态。V3-0324采用MIT许可证,允许自由修改、分发及商业化应用,进一步降低了开发者的使用门槛。

清华大学新闻学院、人工智能学院教授沈阳25日对《环球时报》记者表示,DeepSeek-V3-0324不仅是V3系列的一次迭代,更是中国AI技术崛起的又一力证。其在性能、效率和开源策略上的综合优势使其在全球大语言模型领域占据重要地位。未来,DeepSeek可能通过推理能力提升和多模态扩展来巩固技术领先优势,同时在中美竞争和社区生态中寻找平衡。沈阳认为,DeepSeek-V3-0324的发布看似是一次“小更新”,但其性能跳跃表明该团队可能在为后续重大版本(如传言中的DeepSeek-R2或V4)铺路。

路透社今年2月底引述3名知情人士的说法宣称,DeepSeek原计划在今年5月初发布R2,但现在希望尽早推出,具体时间尚未透露。此外,DeepSeek希望新模型在代码生成和多语言推理方面的表现进一步提升。不过,外媒的相关传言并没有得到DeepSeek公司的证实与回应。


沈阳表示,DeepSeek-V3-0324的推出进一步凸显中国AI企业在技术与成本上的竞争力。美国对华GPU出口限制可能促使中国企业加速国产硬件适配,同时其开源模式或引发西方厂商的连锁动作,例如推出更强闭源模型。2025年可能是中美AI竞争的分水岭。

沈阳认为,在OpenAI公司的GPT大模型要把通用大模型和推理大模型融合在一起的背景下,外界关注包括DeepSeek在内的中国头部大模型是不是最终也会出现这种合并的趋势。“这种可能是存在的,因为对于用户来说,并不关心大模型在回应自身问题时用的是什么类型的模型,更关心大模型能不能给出更为智能、合理的参考答案。”

(来源:环球时报)


“外界热议:DeepSeek又变强了!” 的相关文章

卓繁信息发布循道 DeepSeek 大模型一体机 打造基垂融合智能体新标杆

卓繁信息发布循道 DeepSeek 大模型一体机 打造基垂融合智能体新标杆

近日,卓繁信息正式推出循道DeepSeek大模型一体机政企双版本,标志着人工智能软硬一体化解决方案在政企领域迈出重要一步。技术创新——双模型驱动构建行业智能中枢循道DeepSeek大模型一体机的核心优...

四川宝妈用DeepSeek攻略带娃游峨眉山:省时又合理,特色菜都推荐了

四川宝妈用DeepSeek攻略带娃游峨眉山:省时又合理,特色菜都推荐了

5月4日,四川成都的何女士带着两个女儿游览峨眉山,并不时和打印出来的旅行攻略对比,以确认完成行程后能赶上火车返回成都。何女士告诉极目新闻记者,这次亲子游的攻略她都是用DeepSeek做的,先向AI提出...

关于DeepSeek的常见误区与真相

关于DeepSeek的常见误区与真相

最近,DeepSeek火得有点不讲道理。从我的朋友圈到国外媒体,从华尔街到硅谷,几乎所有人都在热议这个中国AI新秀。560万美元训练成本、开源大模型、链式推理能力、股市动荡...故事真是越讲越玄乎,热...

众多产业行业与DeepSeek“联姻结对”,将为我们带来什么?

众多产业行业与DeepSeek“联姻结对”,将为我们带来什么?

新华社北京2月17日电 DeepSeek在多家医院完成本地化部署;微信测试接入DeepSeek;部分地区政务系统已接入……众多行业产业与DeepSeek“联姻结对”的消息接踵而至,令人不禁想问:AI正...

DeepSeek第五弹炸裂收官!开源并行文件系统,榨干SSD全部带宽

DeepSeek第五弹炸裂收官!开源并行文件系统,榨干SSD全部带宽

DeepSeek开源周,今日正式收官!内容依旧惊喜且重磅,直接公开了V3和R1训练推理过程中用到的文件系统。具体来说,包括以下两项内容:Fire-Flyer文件系统(简称3FS,第三个F代表File)...

中美Robotaxi狂飙量产:自动驾驶进入DeepSeek时刻

中美Robotaxi狂飙量产:自动驾驶进入DeepSeek时刻

打造可复制的商业模板,成为自动驾驶领域的DeepSeek,或许才是Momenta在L4的目标。作者|杨 铭编辑|刘珊珊无人驾驶出租车撕开雨幕,在城市高楼林立间疾驰,成为城市出行重要参与者——这是人类对...