DC娱乐网

#DeepSeekV4.1Flash发布# 这个模型是很不错的,552B,规模中等,性能非常好,还支持多模态。 deepseek的降成本能力还是厉害: KV Cache大幅缩减,对HBM需求降至上一代的1/4、SSD需求降至1/8,Agent场景缓存命中成本大幅降低;相对初代模型,KV Cache已缩减至原来的1/437。 但是这个价格,梁文谷还可以 ​

DeepSeekV4.1Flash发布这个模型是很不错的,552B,规模中等,性能非常好,还支持多模态。

deepseek的降成本能力还是厉害:KV Cache大幅缩减,对HBM需求降至上一代的1/4、SSD需求降至1/8,Agent场景缓存命中成本大幅降低;相对初代模型,KV Cache已缩减至原来的1/437。

但是这个价格,梁文谷还可以,梁文峰还是太贵了。

可以确定的是,deepseek v4 pro确实可以埋了,没啥用了,还占资源。这相当于官方承认这个模型训崩了。前面一堆吹这个模型的,显然是没自己用一下,纯是跟风。