当前位置:首页 > DeepSeek技术交流 > 正文内容

文心大模型X1对上最新版DeepSeek V3,表现谁更好?

1个月前 (03-27)DeepSeek技术交流114

3月26日,在多个公开数据集测评中,百度最新发布的文心大模型X1,在数学、代码、推理等能力上表现优异,超越升级后的DeepSeek-V3-0324。

在数学场景中,GSM8K数据集测试后结果显示,文心X1得分95.6,DeepSeek-V3-0324得分93.6;代码生成层面,HumanEval数据集测试后结果显示,文心X1得分90.9,DeepSeek-V3-0324得分86.6;在知识推理层面,C-Eval数据集测试后结果显示,文心大模型X1得分88.6,DeepSeek-V3-0324得分85.1。

近日,DeepSeek官方宣布V3模型完成小版本升级的消息,包括推理、前端开发、中文写作、中文搜索几个方面的能力优化。

而在不久前,百度正式发布文心大模型X1,具备更强的理解、规划、反思、进化能力。文心X1由百度的慢思考技术发展而来。作为能力更全面的深度思考模型,兼备准确、创意和文采,在中文知识问答、文学创作、文稿写作、日常对话、逻辑推理、复杂计算及工具调用等方面表现尤为出色。

据悉,文心大模型X1即将上线千帆大模型平台,API调用价格为DeepSeek-R1调用价格的50%。


“文心大模型X1对上最新版DeepSeek V3,表现谁更好?” 的相关文章

朱民:大家现在都在讲DeepSeek,这是未来的全球化

朱民:大家现在都在讲DeepSeek,这是未来的全球化

北京商报讯(记者李海媛)3月25日至3月28日,博鳌亚洲论坛2025年年会在海南博鳌举行。3月27日,在“构建开放世界经济:挑战与出路”分论坛中,中国国际经济交流中心副理事长、国际货币基金组织原副总裁...

飞书低代码平台已全面接入Deepseek R1模型能力

飞书低代码平台已全面接入Deepseek R1模型能力

钛媒体App 2月14日消息,飞书低代码平台已全面接入Deepseek R1模型能力。平台提供大量AI增强能力,开发者可在流程中直接调用DeepSeekR1模型,对数据进行批量自动化处理。此外,页面中...

上海中小幼学生开学:“用DeepSeek赶作业”受关注,他们怎么看?

上海中小幼学生开学:“用DeepSeek赶作业”受关注,他们怎么看?

 2月17日,上海约225万名中小学生和幼儿迎来了春季新学期第一天。为了迎接新年后的首次相聚,中小学和幼儿园精心做了各项准备,和孩子们来一场双向奔赴的开学之约。  澎湃新闻记者注意到,开学前几天是疯狂...

特斯联极特DeepSeek一体机发布,加速智能体商业场景落地

特斯联极特DeepSeek一体机发布,加速智能体商业场景落地

计算成本的加速下降,令大模型持续向端侧及边缘侧落地,越来越多的企业开始尝试用大模型技术实现不同模态数据间的相互理解和转换,催生了智能体的出现。有业内人士表示,智能体或将成为人类充分利用AI的关键所在。...

学烧菜、学剪视频,老年居民学用DeepSeek解锁智能生活

学烧菜、学剪视频,老年居民学用DeepSeek解锁智能生活

随着人工智能发展火热,DeepSeek问世后掀起了一股全民学习的热潮。近日,四平路街道阜新路社区睦邻中心组织开展了专门的教学活动,教老年人如何使用Deepseek并普及人工智能知识,助力老年人跨越“数...

安徽移动铜陵分公司推动DeepSeek大模型本地化部署卓有成效

安徽移动铜陵分公司推动DeepSeek大模型本地化部署卓有成效

今年以来,DeepSeek大模型风靡全球,在国内外科技领域掀起了AI热潮,为响应人工智能技术快速迭代趋势,推动AI大模型在本地普及和应用落地,安徽移动铜陵分公司(以下简称:铜陵移动)积极推动DeepS...