栏目分类
你的位置:kai云体育app官方登录入口(中国)官方网站 IOS/安卓通用版/手机版 > 新闻中心 >
出品|搜狐科技
作家|郑松毅
剪辑|杨锦
莫得V4也莫得R2,DeepSeek此次选拔用升级模子V3.1交卷。
数小时前,DeepSeek在用户群低调示知,“线上模子版块已升级至V3.1,高下文长度拓展至128K,迎接前去官方网页、App、小容颜测试,API接口调用方式保捏不变。”
搜狐科技不雅察发现,DeepSeek现时已开源DeepSeek V3.1-Base版块,相关文献已上传至Hugging Face平台。尽管发布方式低调,但DeepSeek在Hugging Face趋势榜单中已上涨至第3名。
张开剩余81%本次发布有一个细节值得提防,DeepSeek 的官方网站上,原来在 “深度念念考” 这个功能的开关按键上有 “R1” 的象征,面前这个象征被去掉了。
业内估计,DeepSeek是否也要走OpenAI的道路,把V系列的快速反映模子和R系列的深度念念考模子整理消亡,杀青GPU共用,养息起来更浅易?
这么来看,环球齐在等的R2是否还会发布亮相,可能要打上一个问号。
编程才气升迁,推理和“幻觉”问题并未改善
从DeepSeek官方宣传点来看,V3.1更新最大的宣传点在于高下文长度升级到了128K(之前64K)。也即是一次性能承载和科罚更多信息,举例篇幅较长的文档和代码。
技能方面,V3.1在架构层面选用了DeepSeek V3系列的枢纽技能,包括MLA、MoE等,参数目与V3版块换取。
模子一发布,全网粉丝争先上手体验。从精深实测反馈来看,新模子V3.1在Token使用上有较大改良,使用量较0324版块着落约13%,意味着老本的进一步从简。但抽象推理才气方面确切莫得彰着高出,“幻觉”问题也曾被诟病。
有业内测评员提到,“V3.1并未看到‘幻觉’问题的改善迹象,比如在年报转头任务上,V3.1在枢纽信息纲目上造作频发,以致泄漏不如旧版。”
另有测评者示意,“我从六个维度实测了新模子的变化,包括数学推理、逻辑分析、代码生成等。湮灭让东说念主偶而:V3.1的推理才气莫得升迁,某些场景下以致不如之前的旧版块。”
被悔悟最多的,要属“中英文混杂”问题。“(这个问题)险些在旧版块是不存在的,而在V3.1里,中英羼杂却随地可见。尤其推理到一定长度后,大要率会运行切换到英文进行念念考。而且V3.1的羼杂问题比其他存在雷同问题的国产模子要略微严重一些,他会在单词的粒度上往还换话语,这给阅读输出内容形成了极大的打扰。”有测试者示意。
有一种讲明是,“这是强化学习的反作用,因为最新的论文中有提到混杂使用各式话语反而能使模子的推理才气增强,大模子厂商在作念雷同的尝试。”
但新模子V3.1的更新也并非毫无亮点。比如V3.1在回答内容信息上有进一步加多,提供了更多细节,口吻也更为轩敞。在代码编程、可视化恶果、物意会任才气上也有所升迁。
此外,在多话语撑捏方面,V3.1版块能科罚超越100种话语,尤其对亚洲话语和资源较少的语种进行了彰着的才气优化。
从枢纽测试湮灭来看,V3.1 在AIME2025数学竞赛测试中准确率升迁至87.5%,较旧版R1的70%有所升迁。LiveCodeBench编程测试中,V3.1的泄漏险些与OpenAI o3-high格外,展示出优秀的编程才气。
DeepSeek坐不住了?
2024年1月5日,DeepSeek发布了首个大模子DeepSeek LLM。同庚12月,精致上线DeepSeek-V3模子,并同步开源。到2025年1月20日,DeepSeek-R1推理大模子发布,凭借低老本并排国外顶尖模子,引起全球震撼。
自此,DeepSeek被视为国产“AI黑马”, 圈内永恒对其保捏高度关注。
但半年多时间畴前了,备受期待的R2模子不竭“跳票”,反而在这时用“不痛不痒”的模子轻量更新友卷,未免让东说念主疑心起背后原因。
除了开始提到的,一种估计是DeepSeek在作念消亡V系列和R系列模子的再行念念考,但也有另一种声息合计,“面临竞争压力,DeepSeek有些坐不住了。”
从插足夏天运行,Google、xAI、OpenAI等AI赛说念头部玩家接踵发布新模子“亮剑”。相较之下,尽管众人一直期待DeepSeek能有所算作回报,但其一直在保捏“千里默”情景。
关于不竭“跳票”,业内精深合计有两个主要原因:其一是面临好意思国新一轮芯片出口铁心,算力问题给DeepSeek带来新的挑战;另一原因在于CEO梁文锋对面前新模子的才气升迁还不得志,想“憋个大招”出来。
“千里默”自己并非有失,但从市集的现实选拔来看,用户的流失率正在“敲警钟”。
QuestMobile 在《2025 年二季度AI诓骗价值榜》中提到,DeepSeek 月均下载量从第一季度的 8111.3 万猛降至 2258.9 万,下滑超越 70%。活跃用户限制方面,从2025年3月的1936.1万降至6月的1629.5万,下滑趋势彰着。
虽有360集团独创东说念主周鸿祎对此讲明,“DeepSeek自己是开源模子,它的技能底座被粗拙诓骗于第三方平台。也即是说,有精深诓骗场景并莫得告成体面前流量数据中,其履行价值远非粗野的下载数据所能体现。”但DeepSeek的热度正在落潮,确切是不争的事实。
更现实的是,在技能日眉月异的AI赛说念,永劫期不更新版块的后果是在排行榜单中呈现可见的“过期”。
字据Artificial Analysis最新大模子排行榜单,DeepSeek已从昔日“领跑”变为“中游”水平,OpenAI、Google、阿里巴巴等竞争敌手跃至前位。
对DeepSeek来说,廓清不会喜悦于此。
从另一角度看,也许是市集对DeepSeek的关注关切显耀超越国内其他大模子团队,以致令其背起抗击OpenAI、Google的重担。但现实规则是,技能奇点的爆发从来不是一蹴而就。对DeepSeek亦然通常,需要再多些耐性。
正如梁文锋所说开云kaiyun,“翻新本即是立志且低效的,最让咱们抖擞的是搞清想到而不是既定事实。在这一波海潮里,咱们的起点,就不是顺便赚一笔,而是信得过走到技能的前沿,激动所有这个词生态发展。”
发布于:北京市
下一篇:开云kaiyun.com同期@数码闲聊站还提到-kai云体育app官方登录入口(中国)官方网站 IOS/安卓通用版/手机版
