当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek又得了个第一

2年前 (2025-02-15)Deepseek最新资讯602

智东西2月14日报道,刚刚,DeepSeek在开源社区Hugging Face上的点赞数跃居第一,获约8730次点赞,这一数字仍在持续上涨。



这是继DeepSeek应用力压ChatGPT登顶美区App Store免费榜、模型在开源社区GitHub上Star数首次超越OpenAI之后,DeepSeek创下的又一个历史时刻,在海外平台再次登顶。


Hugging Face点赞榜单前十名的模型中,都曾在不同节点引爆整个大模型产业。


排名第二的是曾以AI生图“新王”名号横空出世的FLUX.1,由StableDiffusion原班人马成立的黑森林工作室打造,点赞数约8710次。


排名第六的是全球1000名科学家组成BigScience打造的参数高达1760亿个的超大NLP模型BLOOM,第八的是欧洲AI独角兽Mistral AI基于MoE架构的模型Mixtral-8x7B,其余六席被Meta的Llama系列模型和StabilityAI家的模型包揽。


OpenAI的语音转录模型Whisper-large-v3被挤出前十名之列,排名第11,点赞数约3810次。


此外,DeepSeek-V3的排名在第19名,点赞约3810次,超越了微软的Phi-2和谷歌Gemma-7B模型。


Hugging Face点赞数排行榜前30的还有DeepSeek另一款开源的多模态模型Janus-Pro-7B,该模型在使用文本提示的图像生成排行榜中优于OpenAI的 DALL-E 3和Stability AI的Stable Diffusion。



▲开源社区Hugging Face点赞榜(图源:Hugging Face)


DeepSeek V3、DeepSeek R1、Janus-Pro-7B分别于2024年12月26日和今年1月20日、1月28日发布。


DeepSeek V3为DeepSeek自研MoE模型,参数量达到671B,激活参数量37B,在14.8T token上进行了预训练,该模型在多项评测成绩超越了Qwen2.5-72B和Llama-3.1-405B等开源模型,并在性能上和闭源模型GPT-4o以及Claude-3.5-Sonnet比肩。


DeepSeek R1在数学、代码、自然语言推理等任务上,性能比肩OpenAI o1正式版,在开源DeepSeek-R1-Zero和DeepSeek-R1两个660B模型的同时,蒸馏了6个小模型,其中32B和70B模型在多项能力上实现了对标OpenAI o1-mini的效果。


多模态模型Janus-Pro是去年发布的Janus的高级版本,可显著提高多模态理解和视觉生成。


当下,全球已经掀起了从芯片企业、云计算巨头到各路基础设施公司适配、接入DeepSeek的热潮,DeepSeek所展现出的卓越性能与广泛的应用潜力正在逐渐放大。


“DeepSeek又得了个第一” 的相关文章

科蓝软件:公司已将DeepSeek-R1模型整合至公司的人工智能应用平台-魔聚平台

科蓝软件:公司已将DeepSeek-R1模型整合至公司的人工智能应用平台-魔聚平台

每经AI快讯,有投资者在投资者互动平台提问:请问董秘,公司是否接qudeepseek,有没有接入的计划。科蓝软件(300663.SZ)3月5日在投资者互动平台表示,公司已成功将DeepSeek-R1...

DeepSeek在多个领域拥有巨大应用潜力

DeepSeek在多个领域拥有巨大应用潜力

本报讯记者张守营报道近日,由资深人工智能应用专家卢森煌撰写的《高效使用DeepSeek》正式出版。本书被誉为“保姆级”DeepSeek使用指南,旨在帮助个人和企业零基础掌握AI工具的高效应用方法,覆盖...

大连企业发布全国首款公交专属DeepSeek一体机

大连企业发布全国首款公交专属DeepSeek一体机

记者近日从高新区智达科技公司了解到,该公司成功发布基于DeepSeek大模型的公交行业专属一体机Z-AI Cube,为全国首款。智达科技为国家高新技术企业和国家级专精特新“小巨人”企业,专注于“公共交...

石鼓区:Deepseek助力卫生健康事业迈向高质量发展

石鼓区:Deepseek助力卫生健康事业迈向高质量发展

红网时刻新闻4月4日讯(通讯员 符孝龙)4月3日上午,由衡阳联通石鼓区分公司与衡阳市石鼓区卫生健康局联合主办的“Deepseek赋能卫生健康事业高质量发展”主题交流会在石鼓区成功举行。石鼓区卫健局班子...

家家都有DeepSeek服务,如何谎称速度快?

家家都有DeepSeek服务,如何谎称速度快?

原创 亲爱的数据 亲爱的数据不是人人都有“钞能力”,我们的故事,从用单节点方案部署DeepSeek-R1开始。为什么是单节点呢?因为H200单卡有140GB显存,可用单节点(8卡)方案部署。而H800...

昇腾+DeepSeek大模型助力职业院校低成本打造AI实训标杆

昇腾+DeepSeek大模型助力职业院校低成本打造AI实训标杆

随着移动互联技术、云计算和人工智能等新兴技术的快速发展及其在各行业的广泛应用,各职业高校教育正面临新的机遇与挑战,职业院校作为培养应用型和技术型人才的重要阵地,亟需探索高效、高质量的实训课程新模式。在...