当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布新一代AI模型:推理更强,使用成本降一半

11个月前 (09-30)Deepseek最新资讯421

  中国人工智能开发商 DeepSeek 推出了一款实验性大型语言模型(LLM),号称在训练与推理能力上有显著提升,并能以更低的成本运行。

  总部位于杭州的DeepSeek表示,该模型采用 稀疏注意力(sparse attention) 技术,使得API(应用程序接口)调用价格可降低一半。API是企业和开发者接入AI模型的主要方式,按使用次数或调用量付费。

  DeepSeek在开发者社区 Hugging Face 上发布文章称,这款新模型是其“下一代AI产品线的重要进展”。

  随着国内外竞争日益激烈,中国科技企业正不断升级自研大模型。就在上周,巴巴推出了其迄今规模最大、功能最强的新一代旗舰模型。

  事实上,谷歌与OpenAI等国际巨头早在2019年就探索过稀疏注意力技术。OpenAI当时指出,对于超大规模输入,完整的注意力矩阵计算成本过高deepseek,而“稀疏模式”可通过只关注部分关键输入,大幅提高效率。

  DeepSeek在随新模型发布的论文中介绍称,该模型采用了 “闪电索引器(lightning indexer)” 与 “精细化的token选择机制”,确保注意力计算仅应用于最相关的token。

  值得注意的是,华为云已在周一晚间发文确认,已“快速完成”对 DeepSeek-V3.2-Exp 模型的适配工作。

  目前,DeepSeek的V3.1版本与阿里巴巴的通义千问Qwen3系列,在人工智能分析平台的全球LLM排名中位列中国前两名,仅次于OpenAI、xAI与Anthropic等国际厂商。原文出处:DeepSeek发布新一代AI模型:推理更强,使用成本降一半,感谢原作者,侵权必删!

标签: deepseek

“DeepSeek发布新一代AI模型:推理更强,使用成本降一半” 的相关文章

DeepSeek助力算力与算法平权,AI界聚焦高质量数据集 数博会

DeepSeek助力算力与算法平权,AI界聚焦高质量数据集 数博会

  “DeepSeek的开源推动了算力和算法的平权,但数据平权仍面临挑战。”北京交通大学信息管理理论与技术国际研究中心(ICIR)特聘教授张向宏在接受《中国经营报》记者采访时指出,高质量数...

全球首个!蜜丝婷开启美妆抗光损DeepSeek时刻

全球首个!蜜丝婷开启美妆抗光损DeepSeek时刻

  以“AI御光,不止防晒”为主题,防晒头部品牌MISTINE蜜丝婷线粒体抗光损科技国际学术研讨会暨第四届光生物学峰会在此启幕。会上,MISTINE蜜丝婷正式发布诺奖共研全球首创AI线粒体...

DeepSeek强势回归,开源IMO金牌级数学模型

DeepSeek强势回归,开源IMO金牌级数学模型

  顾名思义,这是一个数学方面的模型。它的上一个版本 ——DeepSeek-Math-7b 还是一年多以前发的。当时,这个模型只用 7B 参数量,就达到了 GPT-4 和 Gemini-U...

DeepSeek V3.1 Base突袭上线!击败Claude 4编程爆表,全网

DeepSeek V3.1 Base突袭上线!击败Claude 4编程爆表,全网

  :V3.1在Aider编程基准测试中取得71.6%高分,超越Claude Opus 4,同时推理和响应速度更快。   这次最明显的变化是,DeepSeek在官方APP...

2月2日DeepSeek预测:国王vs奇才,奇才主场险胜,萨尔与乔治成关键

2月2日DeepSeek预测:国王vs奇才,奇才主场险胜,萨尔与乔治成关键

  北京时间2月2日,NBA常规赛将迎来一场东西部垫底球队的较量,华盛顿奇才队将在主场迎战萨克拉门托国王队。两支球队目前战绩均为12胜,分别排在东部和西部的第15位。这场比赛对于双方来说都...

机构:豆包月活超越DeepSeek,跻身8月中国原生AI App月活第一

机构:豆包月活超越DeepSeek,跻身8月中国原生AI App月活第一

  据QuestMobile最新发布的AI行业发展数据,今年8月份,原生App、In-App AI及手机厂商AI助手均持续保持稳定增速,整体规模分别达6.45亿和5.29亿;PC端未如预期...