9月10日中午12点,DeepSeek把V4.1 Flash正式版放了出来。同一时间,WorkBuddy国内版全量接入,模型列表里多了一行,倍率写着0.03x,旁边还有个小标签「独家优惠」。 社区管这事叫「梁圣归来」。创始人梁文锋,降价的时候被喊梁圣,涨价的时候被叫梁子。这次V4.1 Flash一出,称号又回来了。我看了一眼那个0.03x的数字,第一反应跟很多老用户一样,又能猛蹬了。 WorkBuddy的倍率怎么理解,我拆开说一下。平台给每个模型挂一个系数,做完任务扣多少积分按这个走,倍率越低越省钱。现在的列表挂出来大概是这么个排面。 DeepSeek V4.1 Flash,0.03x GLM-5.3 Flash,0.06x 老版 DeepSeek V4 Flash,0.17x MiniMax M3,0.25x 老版 DeepSeek V4 Pro,0.51x GLM-5.3,0.79x Kimi K3,1.62x 0.03x跟1.62x中间隔了54倍。你不用管积分和token之间怎么换算,平台那套东西本来也没公开。你只要知道一件事,原来选Kimi K3跑一个任务要花掉的积分,换成V4.1 Flash够你跑54次。这个换算不需要任何假设,就是两个数字直接除。 倍率说到底只是WorkBuddy自己的定价策略,模型本身行不行才是底子。V4.1 Flash这次几个硬指标,值得一件一件看。 552B参数的MoE模型,用了全新的Causal-Encoder-Decoder结构。讲成大白话,输入和输出不对称,输入激活只走8B参数,输出走16B。这个设计让成本压得比同尺寸模型低出一大截。KV Cache对HBM的需求砍到了上一代的四分之一,SSD需求砍到了八分之一。 跑分也够硬。官方基准测试里,V4.1 Flash直接越级压过了DeepSeek V4 Pro、GLM 5.3、Kimi K3这些旗舰模型。一个小尺寸模型把大号前辈打翻在地,这事儿在AI圈不常见。生成速度还快了将近两倍。 多模态是这次另一个真变化。V4.1 Flash原生就能吃图片,看图识字、分析截图、读图表全都能干,JPEG、PNG、GIF、WebP通吃。以前想让模型看图,得另外接一套东西,现在打开就能用。 价格当然也降了。闲时缓存命中价杀到0.02元每百万token,比之前砍了60%。缓存未命中输入降到1.0元,输出降到4.0元。高峰时段(工作日早上九点到中午十二点、下午两点到六点)价格翻倍,这个别忘了。 有个容易踩的坑我还是多说一句。输出价格只降了11%,降幅最大的那块是缓存命中。你的任务以生成为主、上下文不怎么重复,体感其实有限。反过来,Agent反复带相同的system prompt和历史对话,缓存命中率天然高,这一波才真划算。 回到WorkBuddy的语境。0.03倍这个数字,背后是DeepSeek自己先把API价格打下来,WorkBuddy再把倍率压到极限,两层叠加。普通用户不用关心token,也不用操心峰谷时段,只管用,积分烧得比以前慢太多了。 更实在的还在后面。V4 Pro马上就要退役了,官方已经在安排迁移路径。原来跑在V4 Pro上的工作流,现在直接换到V4.1 Flash,不仅更快更便宜,能力还往上走了一截。 两周免费试用现在已经开了。不管你以前用没用过WorkBuddy,想上手摸一把的可以上去试试。0.03倍这个数,我估计短期内不会有第二个模型追得上来。 特别