DeepSeek又发重磅更新 行业梦回2025年春天_新浪财经_新浪网

时间:2026-08-09 01:03:21来源:知来藏往网 作者:探索
DeepSeek又发重磅更新 行业梦回2025年春天_新浪财经_新浪网
7月31日下午,重磅DeepSeek在API文档更新日志里低调地挂出一则通知:V4-Flash正式版(或V4-Flash-0731)上线公测。更新随后,行业开发者社区出现一个反常的年春事实——V4-Flash正式版在总参数、激活参数上未在原先V4-Flash预览版基础上开展任何变化,天新但其代码和智能体能力,浪财浪网竟“突变式”地实现了全球不过尖模型的经新水平。2026年以来,重磅头部开源模型竞争进入“万亿参数时代”。更新更大的行业算力集群顺理成章地再次成为模型能力突破的题。但这次,年春DeepSeek似乎再次打破了这一逻辑惯性——就像2025年春天那样。天新自“GPT时刻”以来,浪财浪网“算力即智力”的经新规模法则(Scaling Law)被硅谷和全球资本市场奉为圭臬。直到2024年末DeepSeek V3上线、重磅2025年1月R1发布——前者以不到600万美元训练成本比肩GPT-4o,后者以纯强化学习馗逼近OpenAI o1。“规模法则”首先次遭遇正面质疑,英伟达单日市值蒸发5000亿美元,“DeepSeek时刻”由此得名。然而,“DeepSeek时刻”并未结果此后各大模型企业的参数竞赛。进入2026年,“规模法则”卷土重来:4月,DeepSeek V4-Pro预览版以1.6万亿的总参数、490亿激活参数开局;7月阿里Qwen 3.8-Max预览版将总参数推到2.4万亿;同月,月之暗面Kimi K3以2.8万亿参数登不过全球开源模型规模之王座。“大力出奇迹”重回舞台中央——直到7月31日,DeepSeek V4-Flash-0731正式发布,堆参数的逻辑惯性才被踩下刹车。根据DeepSeek官方披露,V4-Flash正式版在九项智能体与代码基准得分上,全部超过自家1.6万亿总参数、490亿激活参数的V4-Pro预览版。其中,在九项基准之中的“DeepSWE”基准上,V4-Flash正式版与Pro预览版的分差实现惊人的41.6分;而在“ALE”基准上,V4-Flash正式版甚至与全球不过级的Claude Opus 4.8仅差半分。也就是说,V4-Flash正式版仅采取了Pro预览版六分之一的总参数,以及不到四分之一的激活参数,便大幅度实现了对Pro预览版的反超。如果只将视角停留在V4-Flash正式版和Pro预览版上,你似乎能轻易地得出一个结比如:“规模法则”在这儿失灵了。当然,没人会觉得“规模法则”真的失灵。在更新验明正身中,DeepSeek清楚表示,V4-Flash正式版基准测试采取了自研的类似“Codex”的工具——DeepSeek Harness极简模式来跑分。加上此次DeepSeek采取了重做后训练的方式,加大了智能体与工具采取方向的专家训练力度,许多AI工程创新的叠加,才在真正意义上让DeepSeek再次成为算力之外的“X因素”。当然,V4-Flash正式版也并非完美。21世纪经济报方式记者注意到,部分海外开发者社区用户指出,V4-Flash正式版的输入缓存命中率偏低、安全分类器频仍超时,这在一定程度上反映出,算力和参数储备不足仍将是限制模型能力上限的瓶颈。全球资本市场层面,在V4-Flash正式版上线之后,英伟达、博通、AMD等公司7月31日股价也并未出现剧烈波动。市场已经习惯了DeepSeek创新带来的震撼,也并不认为AI工程技术的往往代是算力需的利空因素。“规模法则远未到上限,国内模型规模受限只是算力不足,不是规律走到尽头。”DeepSeek创始人梁文锋之前在一个广为流传的融资会议纪关键中提到。但他同时也表示,规模不再是唯一杠杆,思维链和智能体将会是下一个杠杆。摩根大通之前也指出,DeepSeek强化了“算力供应扩张、定价纪律、结构性成本曲线压缩”三大支柱,对行业是顺风,而非零和。然而,全球追逐不过尖模型的潮流,其实已经在悄然变化。近日,根据全球多家媒体报方式,部分欧美公司已经最初将中国的大模型嵌入工作流,并利用其实现大部分往往见不鲜任务。仅在最复杂的任务中,这些公司才会调用Anthropic Claude Fable等不过尖模型。以上变化无疑与中国模型采取成本偏低有关。而另一部分,美国模型采取权限的不可控,也让非美地区客户不得不采取备用方式划。部分券商的评比如更值得玩味。天风证券(维权)方式算机缪欣君团队在V4-Flash正式版发布当天,用“大超预期”为之定调,指出其综合能力已接近Opus 4.8、智能体代码能力接近GPT-5.6 Luna,重申看好下半年国产模型链,认为尤其是“成首先性30%+、有基础面”的软件公司会率先受益于AI带来的增量需。这一判断反常之处在于,过去市场常用认为AI模型的持续发展将利空“软件即服务”类企业。而今天,DeepSeek的性价比已经足够令软件公司本身采取并提效,更多因Token账单太贵而不敢采取AI的软件公司能够开发更多高性价比AI互联网服务,过去无法被顺应的AI智能体采取需将变为现实。就在几周前,当Kimi K3冲到2.8万亿参数时,头部玩家常用相信,即便是中国模型也关键比如“更大=更强”的法则,走“大激活+高知识容量”路线。V4-Flash正式版的出现则再次说明,AI发展不只需大力出奇迹,还得慢工出细活。从价格部分来看,此次V4-Flash正式版的输入(缓存未命中)、输入(缓存命中)、输出每百万Token的价格分别为0.14美元、0.0028美元和0.28美元,与“ALE”基准仅半分之差的Claude Opus 4.8相比,三者的价格分别是前者的36倍、179倍和89倍。“梁文锋似乎站在了市面上所有模型玩家的对立面。”一位从事AI初创公司孵化的人士告诉记者。DeepSeek系列模型首先期稳居性价比之王的宝座,导致其余公司必须至少给予比DeepSeek性能更强的模型。类似的观点在V4-Flash正式版发布之后的AI开发者社区中屡见不那么点儿。“梁文锋的DeepSeek成为了一台永不停止的收割机。”一些略激进的观点认为,“所有的AI大模型公司都在梁文锋的前面奔跑,不有效什么方式,它们必须跑到DeepSeek的前面才能生存。”海量资讯、精准解读,尽在新浪财经APP责任编辑:石秀珍 SF183
相关内容
推荐内容