Featured image of post 我不问,它就不做:用 deepseek-v4-flash 的这几天

我不问,它就不做:用 deepseek-v4-flash 的这几天

换了 deepseek-v4-flash 干活,摸清它的脾气了:我不问,它就不做。一开始以为是缺点,用下来发现看人——对我这种习惯把话说全的人,反而是优点。

我不问,它就不做

最近换了个模型干活,deepseek-v4-flash-0731。

用了几天,摸清它的脾气了:我不问,它就不做。

让它改 bug,它就只改那个 bug。三行外有个明显会炸的写法,我不点名,它不碰。改完了也不多问一句——“要不要顺手补个测试"这种话,它从来没说过。

0731 是什么来头

先交代一下背景。

名字里的 0731 就是 7 月 31 号,DeepSeek V4 正式版上线的日子。Flash 是这代里跑得快的那一档,四月底出过预览版,0731 算转正。

架构叫 MoE,混合专家。总参数 2840 亿,但每次只叫醒 130 亿出来干活——像一家养着几百号专家的公司,你提个问题,前台只把最相关的几个人叫出来。所以它便宜、快,还能吃下 100 万 token 的上下文,塞部长篇小说都够。

官方的态度也很直白:这就是个干活的模型。真要啃复杂规划那种硬骨头,官方让你找它大哥 V4-Pro。

它只做我点名的事

“不问就不做"是什么体验,举两个例子。

让它给脚本加个功能。加完,功能是对的。但旁边那个函数命名一塌糊涂,错误处理全裸奔——换有些模型,早顺手帮我重写了。它不动。

再一个,我说"看看这个配置有没有问题”,它就只看配置。配置里引用的脚本有毛病?那不归它看。

也不是说它一次都不会多做,但大多数时候,它只做我点名的事。一开始我以为它懒,后来想明白了:不是懒,是太听话。任务的边界,就是我说出口的那句话,一个字都不多。

这算缺点还是优点,看人

如果你习惯丢一句"帮我把这个弄好"就不管了,那你会很难受。它理解的"弄好”,是最字面的那种弄好。

但我写指令的习惯,本来就是一次说全:改什么、不改什么、怎么算完。这么用下来,它的被动反而让我省心——不会趁我不注意,把不相干的文件也重构一遍。它做的每一步,都在我画的圈里。

我之前写过:AI 是执行者,我是指挥。这个模型最绝的地方就在这:你不指挥,它真不动。

便宜是真便宜

还有个好处很实在:快,而且便宜。

指令没说全?重跑一遍,不心疼。一天几百条指令砸下去,账单没什么感觉。跟那种一句话糊上去、它自由发挥三分钟、账单跟着一起发挥的模型比,这种我说一句它做一步的节奏,我用着更顺手。

最后

有人可能会问:你不嫌它不够主动吗?

不嫌。主动这件事,我自己有。我缺的是一个把话执行得又便宜又准的家伙。

它不会替我想。想,本来就是我自己的活儿。