当前位置:首页 > Deepseek最新资讯 > 正文内容

刚刚,DeepSeek发了“终极版”!

1周前 (09-23)Deepseek最新资讯84

  智东西9月22日报道,今天晚间,DeepSeek在其官方API平台发布了最新升级的DeepSeek-V3.1-Terminus模型(Terminus拉丁语意为终点、界限),并在不久后宣布模型开源。

  官方文档中称,DeepSeek-V3.1-Terminus在保持模型原有能力的情况下,改进了语言一致性、偶发异常字符等DeepSeek-V3.1上线后出现的Bug,还进一步优化了编程和搜索智能体的表现。

  DeepSeek-V3.1-Terminus在HLE(人类终极测试)上的性能提升最为明显,这一测试主要考察专家级的高难度知识和模型的多模态、深度推理等能力。

  而在Agent测评中,DeepSeek-V3.1-Terminus网页浏览、简单问答和多项编程测试中的表现出现小幅提升。

  今年8月,DeepSeek-V3.1上线后,有用户反馈在用API调用模型时,会偶尔出现一个严重Bug:模型会不受控地随机输出“极”、“極”、“extreme”等字样,严重影响日常使用,如果未经仔细检查就使用含有这一Bug的代码,很可能导致编译失败。

  智东西调用了最新的DeepSeek-V3.1-Terminus API,尝试复现上述问题。网传能复现这一问题的“高危”提示词包括要求模型写Go语言、完成版本号相关任务、处理时间等。

  不过,DeepSeek-V3.1-Terminus在测试中并未因上述提示词而出现Bug,也就是说,这一问题应该已经被修复了。

  也有海外用户反映,此前的DeepSeek-V3.1存在多语言的问题,尤其是在翻译小语种时。这位Reddit网友分享,DeepSeek会把中、英、俄三种语言混用,问题文本的比例有时能达到5%。

  智东西尝试着让DeepSeek-V3-Terminus将这句话翻译为7种小语种:“人工智能正在改变我们的世界,它带来了巨大的机遇,也需要我们认真思考其挑战。”

  DeepSeek-V3-Terminus的回答没有出现语言混杂问题,看来这一Bug也被修复了。

  除了Bug的修复之外,DeepSeek-V3.1-Terminus还有一大值得关注的地方是其编程和搜索智能体能力的提升。

  编程任务上,智东西让DeepSeek-V3.1-Terminus尝试了小球弹跳,结果如下。模型输出的网页采用了简约风格,不过,模拟的重力、摩擦力效果十分逼真。要打造这样的效果,模型不仅需要有很强的编程能力,也需拥有对物理学的理解能力。

  在搜索智能体能力方面,我们让DeepSeek-V3.1-Terminus推荐了几款适合新手阳台盆栽的植物。这一测试考察模型能否找出完全符合“阳台盆栽”、“生长快”、“可生食”、“对儿童安全”所有条件的植物。此外,模型也要交叉验证信息的可靠性,并进行整合提炼和风险提示。

  可以看到,DeepSeek-V3.1-Terminus给出的答案考虑十分周全,经人工核查事实无误,可读性也不错。

  DeepSeek-V3.1-Terminus中的“Terminus”,在拉丁语里是“终点”或“界限”的意思,我们试着让DeepSeek自己对这一命名给出了解读。DeepSeek称,这一命名可能象征着DeepSeek-V3.1是这个系列架构的终极版本,代表了当前技术路径的成熟和完善。

  也有网友认为,Terminus可能意味着模型在编程终端里的表现更好了。不过,正如DeepSeek所言,具体的命名寓意最好还是官方来解释更为准确deepseek

  此前,外网有媒体报道称,DeepSeek今年年底即将推出Agent模型。或许,DeepSeek的下一次重大更新,已经不远了。原文出处:刚刚,DeepSeek发了“终极版”!,感谢原作者,侵权必删!

标签: deepseek

“刚刚,DeepSeek发了“终极版”!” 的相关文章

在大巴黎时,你们叫人家姆甜甜;在皇马时,你们叫人家龟夫人

在大巴黎时,你们叫人家姆甜甜;在皇马时,你们叫人家龟夫人

  姆子在皇马态度其实已经端正很多了,至少没有干出进攻端跑了一半就撂挑子不干了这种惊世骇俗的名场面,还要什么自行车。   姆子在皇马态度其实已经端正很...

纪事报:纽卡对等待利物浦筹集资金签伊萨克感到愤怒

纪事报:纽卡对等待利物浦筹集资金签伊萨克感到愤怒

  据纪事报消息,利物浦将用出售努涅斯和迪亚斯的资金来竞购伊萨克,纽卡高层对等待利物浦筹集资金感到愤怒。   消息称,随着塞斯科转会曼联的可能性不断增加,纽卡求购前...

DeepSeek团队Nature发文,登上封面!

DeepSeek团队Nature发文,登上封面!

  “同行评审”在学术界属于常见且必要的论文审查程序,为何此次《自然》单独将其提出,并以“打破空白”来高度评价DeepSeek?事实上,自ChatGPT起,全球范围内大模型发展就犹如一场“...

拆解一品威客平台AI引擎:如何精准匹配创意需求

拆解一品威客平台AI引擎:如何精准匹配创意需求

  在创意经济蓬勃发展的今天,每天有不少企业创意需求与服务商在数字平台中擦肩而过。云南个体户如何精准找到上海的设计师?贵州初创企业如何高效对接北京开发团队?一品威客平台的AI智能匹配引擎,...

OPTA给出了高阶数据,西甲面对多人防守带球过人次数:维尼修斯第一 亚马尔第二

OPTA给出了高阶数据,西甲面对多人防守带球过人次数:维尼修斯第一 亚马尔第二

  其实维尼修斯最恐怖的是这赛季上半赛季,比上赛季还恐怖,60分钟制造一球,萨拉赫都被他压过去了 这是上半赛季的多边形图,只能说小熊的发挥是比上赛季和上半赛季差了 但是很多人太夸张了 什么...

寒武纪Deepseek罕见同步重磅发布,科创AIETF(588790)高开高走涨

寒武纪Deepseek罕见同步重磅发布,科创AIETF(588790)高开高走涨

  等个股跟涨。科创AIETF(588790)上涨2.58%,最新价报0.88元。拉长时间看,截至2025年9月29日,科创AIETF近2周累计上涨3.77%,涨幅排名可比基金3/9。...