当前位置:首页 > Deepseek最新资讯 > 正文内容

刚刚,DeepSeek发了“终极版”!

11个月前 (09-23)Deepseek最新资讯322

  智东西9月22日报道,今天晚间,DeepSeek在其官方API平台发布了最新升级的DeepSeek-V3.1-Terminus模型(Terminus拉丁语意为终点、界限),并在不久后宣布模型开源。

  官方文档中称,DeepSeek-V3.1-Terminus在保持模型原有能力的情况下,改进了语言一致性、偶发异常字符等DeepSeek-V3.1上线后出现的Bug,还进一步优化了编程和搜索智能体的表现。

  DeepSeek-V3.1-Terminus在HLE(人类终极测试)上的性能提升最为明显,这一测试主要考察专家级的高难度知识和模型的多模态、深度推理等能力。

  而在Agent测评中,DeepSeek-V3.1-Terminus网页浏览、简单问答和多项编程测试中的表现出现小幅提升。

  今年8月,DeepSeek-V3.1上线后,有用户反馈在用API调用模型时,会偶尔出现一个严重Bug:模型会不受控地随机输出“极”、“極”、“extreme”等字样,严重影响日常使用,如果未经仔细检查就使用含有这一Bug的代码,很可能导致编译失败。

  智东西调用了最新的DeepSeek-V3.1-Terminus API,尝试复现上述问题。网传能复现这一问题的“高危”提示词包括要求模型写Go语言、完成版本号相关任务、处理时间等。

  不过,DeepSeek-V3.1-Terminus在测试中并未因上述提示词而出现Bug,也就是说,这一问题应该已经被修复了。

  也有海外用户反映,此前的DeepSeek-V3.1存在多语言的问题,尤其是在翻译小语种时。这位Reddit网友分享,DeepSeek会把中、英、俄三种语言混用,问题文本的比例有时能达到5%。

  智东西尝试着让DeepSeek-V3-Terminus将这句话翻译为7种小语种:“人工智能正在改变我们的世界,它带来了巨大的机遇,也需要我们认真思考其挑战。”

  DeepSeek-V3-Terminus的回答没有出现语言混杂问题,看来这一Bug也被修复了。

  除了Bug的修复之外,DeepSeek-V3.1-Terminus还有一大值得关注的地方是其编程和搜索智能体能力的提升。

  编程任务上,智东西让DeepSeek-V3.1-Terminus尝试了小球弹跳,结果如下。模型输出的网页采用了简约风格,不过,模拟的重力、摩擦力效果十分逼真。要打造这样的效果,模型不仅需要有很强的编程能力,也需拥有对物理学的理解能力。

  在搜索智能体能力方面,我们让DeepSeek-V3.1-Terminus推荐了几款适合新手阳台盆栽的植物。这一测试考察模型能否找出完全符合“阳台盆栽”、“生长快”、“可生食”、“对儿童安全”所有条件的植物。此外,模型也要交叉验证信息的可靠性,并进行整合提炼和风险提示。

  可以看到,DeepSeek-V3.1-Terminus给出的答案考虑十分周全,经人工核查事实无误,可读性也不错。

  DeepSeek-V3.1-Terminus中的“Terminus”,在拉丁语里是“终点”或“界限”的意思,我们试着让DeepSeek自己对这一命名给出了解读。DeepSeek称,这一命名可能象征着DeepSeek-V3.1是这个系列架构的终极版本,代表了当前技术路径的成熟和完善。

  也有网友认为,Terminus可能意味着模型在编程终端里的表现更好了。不过,正如DeepSeek所言,具体的命名寓意最好还是官方来解释更为准确deepseek

  此前,外网有媒体报道称,DeepSeek今年年底即将推出Agent模型。或许,DeepSeek的下一次重大更新,已经不远了。原文出处:刚刚,DeepSeek发了“终极版”!,感谢原作者,侵权必删!

标签: deepseek

“刚刚,DeepSeek发了“终极版”!” 的相关文章

堪比DeepSeek时刻!在美中国科技ETF六周连吸金,中国成股票投资首选市场

堪比DeepSeek时刻!在美中国科技ETF六周连吸金,中国成股票投资首选市场

  截至9月19日当周,美国交易的中国科技股ETFKraneShares金瑞中证中国互联网ETF(KWEB)连续第六周获得资金流入,创下今年2月DeepSeek时刻以来的最长纪录。不过最新...

DeepSeek-R1登上《自然》封面,AI大模型从“黑箱”走向透明

DeepSeek-R1登上《自然》封面,AI大模型从“黑箱”走向透明

  9月17日深夜,今年1月引发全球轰动的开源AI大模型DeepSeek-R1,在经过8个多月严格的同行评审之后,登上国际顶尖学术期刊《自然》杂志封面,成为全球首个经过同行评审的大语言模型...

DeepSeek如何秒入非洲农村?分享新质生产力先要通电联网讲堂视频

DeepSeek如何秒入非洲农村?分享新质生产力先要通电联网讲堂视频

  11月中旬,身着“村超带动乡村振兴”之地——贵州榕江的蜡染服饰,印度裔历史学者、三大洲社会研究所主任 Vijay Prashad(维杰·普拉沙德)回到2025年全球南方学术论坛。...

DeepSeek AI新模型曝光:搭载 MODEL1 全新架构,最快2月上线

DeepSeek AI新模型曝光:搭载 MODEL1 全新架构,最快2月上线

  【环球网科技综合报道】1月21日消息,据ITPro报道,DeepSeek计划于今年2月中旬农历新年期间,推出新一代旗舰AI模型DeepSeek V4。该模型将搭载全新技术架构,写代码能...

仅用38分钟!深圳一初创企业跑通DeepSeek新模型国产芯片适配

仅用38分钟!深圳一初创企业跑通DeepSeek新模型国产芯片适配

  1月27日,DeepSeek团队发布了DeepSeek-OCR-2模型。来自深圳的智子芯元公司运用自主研发的KernelCAT工具,仅用38分钟就完成了这款模型在华为昇腾平台的自动化部...

2月7日DeepSeek预测快船vs国王:伦纳德率队延续交锋统治,客场轻取五连败

2月7日DeepSeek预测快船vs国王:伦纳德率队延续交锋统治,客场轻取五连败

  西部中游球队快船将客场挑战垫底球队国王,此役是双方本赛季第二次交手。快船目前以23胜27负排名西部第9,仍保留季后赛希望;而国王仅12胜40负位列西部第15,已基本退出竞争行列。...