DeepSeek又发重磅更新,行业梦回2025年春天|flash|deepseek_网易订阅
时间:2026-08-10 03:16:12 来源:谋事在人网 作者:娱乐 阅读:880次

21世纪经济报方式记者 赵云帆7月31日下午,重磅DeepSeek在API文档更新日志里低调地挂出一则通知:V4-Flash正式版(或V4-Flash-0731)上线公测。更新随后,行业开发者社区出现一个反常的年春事实——V4-Flash正式版在总参数、激活参数上未在原先V4-Flash预览版基础上开展任何变化,网易但其代码和智能体能力,订阅竟“突变式”地实现了全球不过尖模型的重磅水平。2026年以来,更新头部开源模型竞争进入“万亿参数时代”。行业更大的年春算力集群顺理成章地再次成为模型能力突破的题。但这次,网易DeepSeek似乎再次打破了这一逻辑惯性——就像2025年春天那样。订阅DeepSeek时刻又来了?重磅自“GPT时刻”以来,“算力即智力”的更新规模法则(Scaling Law)被硅谷和全球资本市场奉为圭臬。直到2024年末DeepSeek V3上线、行业2025年1月R1发布——前者以不到600万美元训练成本比肩GPT-4o,后者以纯强化学习馗逼近OpenAI o1。“规模法则”首先次遭遇正面质疑,英伟达单日市值蒸发5000亿美元,“DeepSeek时刻”由此得名。然而,“DeepSeek时刻”并未结果此后各大模型企业的参数竞赛。进入2026年,“规模法则”卷土重来:4月,DeepSeek V4-Pro预览版以1.6万亿的总参数、490亿激活参数开局;7月阿里Qwen 3.8-Max预览版将总参数推到2.4万亿;同月,月之暗面Kimi K3以2.8万亿参数登不过全球开源模型规模之王座。“大力出奇迹”重回舞台中央——直到7月31日,DeepSeek V4-Flash-0731正式发布,堆参数的逻辑惯性才被踩下刹车。根据DeepSeek官方披露,V4-Flash正式版在九项智能体与代码基准得分上,全部超过自家1.6万亿总参数、490亿激活参数的V4-Pro预览版。其中,在九项基准之中的“DeepSWE”基准上,V4-Flash正式版与Pro预览版的分差实现惊人的41.6分;而在“ALE”基准上,V4-Flash正式版甚至与全球不过级的Claude Opus 4.8仅差半分。也就是说,V4-Flash正式版仅采取了Pro预览版六分之一的总参数,以及不到四分之一的激活参数,便大幅度实现了对Pro预览版的反超。如果只将视角停留在V4-Flash正式版和Pro预览版上,你似乎能轻易地得出一个结比如:“规模法则”在这儿失灵了。当然,没人会觉得“规模法则”真的失灵。在更新验明正身中,DeepSeek清楚表示,V4-Flash正式版基准测试采取了自研的类似“Codex”的工具——DeepSeek Harness极简模式来跑分。加上此次DeepSeek采取了重做后训练的方式,加大了智能体与工具采取方向的专家训练力度,许多AI工程创新的叠加,才在真正意义上让DeepSeek再次成为算力之外的“X因素”。AI性价比来到“临界点”当然,V4-Flash正式版也并非完美。记者注意到,部分海外开发者社区用户指出,V4-Flash正式版的输入缓存命中率偏低、安全分类器频仍超时,这在一定程度上反映出,算力和参数储备不足仍将是限制模型能力上限的瓶颈。全球资本市场层面,在V4-Flash正式版上线之后,英伟达、博通、AMD等公司7月31日股价也并未出现剧烈波动。市场已经习惯了DeepSeek创新带来的震撼,也并不认为AI工程技术的往往代是算力需的利空因素。“规模法则远未到上限,国内模型规模受限只是算力不足,不是规律走到尽头。”梁文锋之前在一个广为流传的融资会议纪关键中提到。但他同时也表示,规模不再是唯一杠杆,思维链和智能体将会是下一个杠杆。摩根大通之前也指出,DeepSeek强化了“算力供应扩张、定价纪律、结构性成本曲线压缩”三大支柱,对行业是顺风,而非零和。然而,全球追逐不过尖模型的潮流,其实已经在悄然变化。近日,根据全球多家媒体报方式,部分欧美公司已经最初将中国的大模型嵌入工作流,并利用其实现大部分往往见不鲜任务。仅在最复杂的任务中,这些公司才会调用Anthropic Claude Fable等不过尖模型。以上变化无疑与中国模型采取成本偏低有关。而另一部分,美国模型采取权限的不可控,也让非美地区客户不得不采取备用方式划。部分券商的评比如更值得玩味。天风证券方式算机缪欣君团队在V4-Flash正式版发布当天,用“大超预期”为之定调,指出其综合能力已接近Opus 4.8、智能体代码能力接近GPT-5.6 Luna,重申看好下半年国产模型链,认为尤其是“成首先性30%+、有基础面”的软件公司会率先受益于AI带来的增量需。这一判断反常之处在于,过去市场常用认为AI模型的持续发展将利空“软件即服务”类企业。而今天,DeepSeek的性价比已经足够令软件公司本身采取并提效,更多因Token账单太贵而不敢采取AI的软件公司能够开发更多高性价比AI互联网服务,过去无法被顺应的AI智能体采取需将变为现实。“站在整个行业的对立面”就在几周前,当Kimi K3冲到2.8万亿参数时,头部玩家常用相信,即便是中国模型也关键比如“更大=更强”的法则,走“大激活+高知识容量”路线。V4-Flash正式版的出现则再次说明,AI发展不只需大力出奇迹,还得慢工出细活。从价格部分来看,此次V4-Flash正式版的输入(缓存未命中)、输入(缓存命中)、输出每百万Token的价格分别为0.14美元、0.0028美元和0.28美元,与“ALE”基准仅半分之差的Claude Opus 4.8相比,三者的价格分别是前者的36倍、179倍和89倍。“梁文锋似乎站在了市面上所有模型玩家的对立面。”一位从事AI初创公司孵化的人士告诉记者。DeepSeek系列模型首先期稳居性价比之王的宝座,导致其余公司必须至少给予比DeepSeek性能更强的模型。类似的观点在V4-Flash正式版发布之后的AI开发者社区中屡见不那么点儿。“梁文锋的DeepSeek成为了一台永不停止的收割机。”一些略激进的观点认为,“所有的AI大模型公司都在梁文锋的前面奔跑,不有效什么方式,他们必须跑到DeepSeek的前面才能生存。”
(责任编辑:热点)
最新内容
- ·罗马夏窗第三签!莫利纳即将降临,签约四年成防线新核|韦尔|红狼|乌迪内斯|卡斯特罗|吉列尔莫·莫利纳_网易订阅
- ·王菲真不把自己当明星!又穿大妈裙+凉鞋出门,这打扮差点认不出_黑色_工装裤_线条
- ·[流言板]约什-史密斯:阿德巴约因詹姆斯没去热火,才没把他排进前五-NBA新闻-虎扑社区
- ·800红利低波ETF华宝(159355)开盘跌0.93%,重仓股雅戈尔跌0.89%,格力电器跌0.28%_新浪财经_新浪网
- ·王艺迪爆冷出局!日本双子星闪耀,国乒该醒醒了横滨的夜,让中国乒乓球迷熬了一个不眠夜|陈幸同|张本智和|横滨冠军赛_网易订阅
- ·园林股份股价涨6.05%,诺安基金旗下1只基金位居十大流通股东,持有83.78万股浮盈赚取94.67万元_新浪财经_新浪网
- ·[流言板]CP:詹姆斯和伦纳德是历史上最令人期待的“如果”组合之一-NBA新闻-虎扑社区
- ·科创综指ETF华泰柏瑞(589990)开盘跌0.97%,重仓股寒武纪跌0.54%,海光信息涨0.00%_新浪财经_新浪网
- ·好消息!龙将军去JD了!!-绝地求生-虎扑社区
- ·港股速报 | 8月行情开门红!恒指突破26000点再创反弹新高,阿里巴巴涨超6%_蔡崇信_公司_建议
热点内容
- ·市场风格再平衡 微盘股ETF重获资金关注_新浪财经_新浪网
- ·A500ETF永赢(159386)开盘跌0.24%,重仓股中际旭创跌1.22%,宁德时代跌0.68%_新浪财经_新浪网
- ·园林股份股价涨6.05%,诺安基金旗下1只基金位居十大流通股东,持有83.78万股浮盈赚取94.67万元_新浪财经_新浪网
- ·中证A500ETF国泰(159338)开盘跌0.58%,重仓股中际旭创跌1.22%,宁德时代跌0.68%_新浪财经_新浪网
- ·飞机起飞途中遭雷击,深圳飞无锡航班滞留3小时临时换机,南航回应:机身发现雷击点20余处,客机自带防雷保护措施,电流不会进入机舱内部|深圳市|无锡市|发动机燃料|中国南方航空_网易订阅
- ·联特科技股价涨5.07%,中欧基金旗下1只基金重仓,持有800股浮盈赚取8968元_新浪财经_新浪网
- ·科创AIETF博时(588790)开盘跌1.25%,重仓股芯原股份跌1.46%,海光信息涨0.00%_新浪财经_新浪网
- ·转发提醒!这10点不注意可能越晒越黑丨中新真探
- ·破防了!国乒男单接连全军覆没!邓亚萍3个月前说的话正在应验,我们确实是误会了!许昕马龙也干着急|世乒赛|梁靖崑|张本智和|奥运会开幕式_网易订阅
- ·[流言板]FIBA U18欧洲杯:斯洛文尼亚队夺冠,意大利&法国获得二三名-CBA-CBA专区-虎扑社区













