DeepSeekV4.1Flash发布这个模型是很不错的,552B,规模中等,性能非常好,还支持多模态。
deepseek的降成本能力还是厉害:KV Cache大幅缩减,对HBM需求降至上一代的1/4、SSD需求降至1/8,Agent场景缓存命中成本大幅降低;相对初代模型,KV Cache已缩减至原来的1/437。
但是这个价格,梁文谷还可以,梁文峰还是太贵了。
可以确定的是,deepseek v4 pro确实可以埋了,没啥用了,还占资源。这相当于官方承认这个模型训崩了。前面一堆吹这个模型的,显然是没自己用一下,纯是跟风。