当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构

2个月前 (08-21)Deepseek最新资讯296

  8月21日,DeepSeek正式发布其最新版本DeepSeek-V3.1,该版本采用了UE8M0 FP8 Scale的参数精度。据悉,这一技术规格专门为即将发布的下一代国产芯片进行优化设计。

  新版本在技术架构方面实现重要突破,引入了混合推理架构设计。该架构允许单一模型同时支持思考模式与非思考模式两种运行状态。用户可通过官方应用程序或网页端的深度思考按钮自由切换不同模式。

  与此同时,V3.1版本在运行效率方面取得显著提升。相比前代DeepSeek-R1-0528,新版本能够在更短时间内提供响应结果。通过思维链压缩训练技术,模型在输出token数量减少20%至50%的情况下,仍能保持相同的任务表现水平。

  在智能体能力方面,V3.1通过后训练优化实现了质的飞跃。新模型在工具使用、编程任务以及复杂搜索等智能体相关任务中表现获得较大幅度提升。在代码修复测评SWE与命令行终端环境测试中,该模型展现出更强的处理能力。

  技术规格方面,V3.1版本将上下文窗口扩展至128K,并新增对Anthropic API格式的支持。API接口同步升级deepseek,提供deepseek-chat与deepseek-reasoner两个不同接口,分别对应非思考模式和思考模式。

  值得注意的是,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异。这些调整旨在更好地适配即将推出的国产芯片硬件环境。

  官方应用程序与网页端模型已同步升级为DeepSeek-V3.1版本。据了解,公司计划于2025年9月6日起执行新的API定价方案并取消夜间优惠政策。原文出处:DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构,感谢原作者,侵权必删!

标签: deepseek

“DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构” 的相关文章

195 万、DeepSeek + AI 智能体大单

195 万、DeepSeek + AI 智能体大单

  云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理deepseek。原文出处:195 万、DeepSeek + AI 智能体...

宁德时代、华为、DeepSeek入选《财富》中国科技50强|快讯

宁德时代、华为、DeepSeek入选《财富》中国科技50强|快讯

  8月21日,2024年《财富》中国科技50强榜单正式揭晓,宁德时代新能源科技股份有限公司再度跻身榜单,与华为、DeepSeek、腾讯等科技领军企业共同彰显中国科技产业实力。...

讲个鬼故事:霍伊伦加盟曼联就进过1粒头球,而塞斯科同期进了8粒!

讲个鬼故事:霍伊伦加盟曼联就进过1粒头球,而塞斯科同期进了8粒!

  除了几个很抽象的单刀 我觉得抢点还可以 射门有时候超神有时候抽象 他有练好头球的条件 但是意愿强不强不知道   除了几个很抽象的单刀 我觉得抢点还可以 射门有时候超神...

硅谷观察:马斯克起诉苹果偏袒OpenAI,却被网友用DeepSeek打脸

硅谷观察:马斯克起诉苹果偏袒OpenAI,却被网友用DeepSeek打脸

  马斯克不爽自家Grok没有上推荐榜,炮轰苹果偏袒合作伙伴OpenAI,威胁要起诉苹果涉嫌垄断操纵应用商店,却被网友用中国应用DeepSeek光速打脸,更被自家的Grok...

DeepSeek的一串“符号”背后:对国产芯片意味着什么?

DeepSeek的一串“符号”背后:对国产芯片意味着什么?

  这是深度求索公司8月份在新发布新模型DeepSeek V3.1的文档中所留下的一个关键信息。   整个8月下旬,这串“符号”成为国产芯片与算力行业在资本市场狂欢的“财...

DeepSeek预测:维罗纳vs国际米兰!蓝黑军团火力全开,劳塔罗能否再破降级区

DeepSeek预测:维罗纳vs国际米兰!蓝黑军团火力全开,劳塔罗能否再破降级区

  意甲第10轮即将上演一场“冰与火之歌”——深陷降级区的维罗纳将在本特戈蒂球场迎战欧冠区劲旅国际米兰。主队9轮仅积5分排名第18,场均0.7球的进攻效率(联赛第17)与1.5的失球数形成...