DeepSeek一度被视作大模型领域的“斩杀线”标杆。凭借卓越的性能和极高的调用性价比,不少综合表现不及DeepSeek系列的同类模型,生存空间受到明显挤压。
然而,这一次,DeepSeek竟然亲自动手,斩杀了还在襁褓中的自家前沿模型V4-Pro。
9月10日,DeepSeek微信公众号发布了V4.1-Flash模型,宣称其“更强、更快、更普惠”,简介则显示,新版模型“大兴土木”:不仅直接改变了V4系列模型的基础架构,还再度降低了前沿模型的总参数和激活参数规模。
更有意思的是,DeepSeek官方直接在发布文档中明确,V4.1-Flash超过了此前饱受开发者群体诟病的V4-Pro,并决定将V4-Pro有序下线,将V4-Pro接口路由至V4.1-Flash。
一边是扩大融资、资本开支和招聘,一边是降价、砍模型,在经历了一段相对混乱的时期之后,DeepSeek正在尝试做减法,找回当年的自己。滑铁卢之后
根据官方公告,V4.1-Flash最显著的改变是引入了一个名为“Causal-Encoder-Decoder”的新架构,用高总参数、低激活输入、高激活输出的方式来改变模型的性能。
按照官方基准测试结果,V4.1-Flash凭借V4-Pro约三分之一的总参数规模,实现了多个权威基准测试得分对V4-Pro的反超。
同时,V4.1-Flash恢复了DeepSeek过去追求“更普惠”的画风:其不仅明确模型加载权重缓存大幅减少,更直言“与上一代模型相比,对HBM(高带宽内存)的需求减少到1/4,对SSD(固态硬盘)的需求减少到1/8”。
这也成为今年存储市场里,令不少投资者感到警惕的一则变化。
对此次DeepSeek发布,开发者社区态度可以概括为一个词——“听劝”。
怎么说?比如,DeepSeek在发布V4.1-Flash时明确,此次调整聚焦模型的原生多模态视觉理解能力。但在此之前,DeepSeek系列模型长期受到诟病,其实际可用的识图能力基本停留在“看图识字”的状态。
另一个“听劝”的动作,则是直接砍掉了问世后便口碑直线下滑的V4-Pro。
一个月前,DeepSeek-V4-Pro正式版在一片期待之中上线。然而开发者社区发现,V4-Pro在测试中大量出现推理任务思考时长不足、长流程提前收尾的问题。同时,在蜂拥而至的任务流下,V4-Pro在推出的几个小时内就出现了大规模的“降智”;大量实测过V4-Pro模型的代码开发者在社区给出了V4-Pro的翻车案例。
加之8月的那次大幅提价,DeepSeek创始人梁文锋在开发者社区的风评,迅速从“梁圣”变成了“梁子”。
DeepSeek这次索性“淘汰”了V4-Pro,将其原结构直接导入新发布的V4.1-Flash。
最后,此次发布将腾讯旗下智能体应用平台WorkBuddy、CodeBuddy和OpenCode作全量接入,弥补了DeepSeek官方智能体生态的不足,体现了DeepSeek确实在广泛听取开发者社区的声音。重回“斩杀线”定位
伴随V4.1-Flash发布的,则是一轮降价。
官方公告显示,DeepSeek-V4.1-Flash仍使用峰谷定价,其闲时输入缓存命中0.02元/百万词元、未命中1元/百万词元、输出4元/百万词元;峰时定价则较闲时价格翻倍。
对比V4-Pro原闲时价(命中0.025元、未命中3元、输出6元),新模型输出降约33%,输入未命中降67%,命中降约20%。
至于更加昂贵的V4-Pro模型,随着其在官方API接口端被“物理消灭”,其价格体系也随模型本体一并消失。
看起来,梁文锋又将DeepSeek拉回到了那个属于他们的“斩杀线”定位上。
9月初,全球AI圈将目光聚焦到了OpenAI最新发布的GPT-6“Astra”身上——过去几天,Astra相继完成了自行折叠蛋白、创造森林、通关游戏等任务。OpenAI甚至宣称其解决了人类目前最前沿的数学难题。
然而开发者社区仍对“Astra”这一神话级模型心存敬畏。OpenAI官方会员的指令配额,会在程序员几次不经意的对话中被消耗殆尽。
大家因此开起了“Astra”的玩笑:“你每个月只能有一次和神对话的机会。”
而在国内,“梁文锋们”看到了前沿模型狂奔的进度和惊人的定价,也开始跃跃欲试。然而在算力与工程积淀的限制下,国内前沿模型的进度似乎并不喜人。
8月开始,DeepSeek陆续作出数个大动作,包括提价、开发并释出官方Harness工具。然而这一系列的动作反响均不尽如人意。提价让其在第三方平台的调用量排名骤降。而官方Harness工具被定位为智能体的“沙盒”,内部却宛如一个毛坯房。在各家大模型厂商都在针对大模型做更好的环境适配时,DeepSeek Harness的超前动作显得与时代格格不入。
资本化这一端,DeepSeek在时隔3个月后再次开启新一轮融资,并于近期正式启动了上市计划。所有人都理解,IPO不仅需要收入的锚定,还需要崭新的叙事来奠基。
毫无疑问,从一家专注AI工程研究的实验室起步,完成融资后的DeepSeek,正成长为国内知名度靠前的MaaS服务商,商业化的收入、竞争对手的觊觎、对前沿模型的追赶等等,一切都变成了梁文锋的压力。而作为中国AI企业的代表,梁文锋无疑需要同时解决好这些问题。
好在如今,梁文锋和DeepSeek已经重新找回了自己的定位。
线上靠谱正规配资
元鼎证券_元鼎证券配资平台-让专业陪你看清行情、让自信陪你走进市场。提示:本文来自互联网,不代表本网站观点。