DC娱乐网

DeepSeek盲眼鲸鱼终于装上了赛博义眼👀 DeepSeek V4-Flas

DeepSeek盲眼鲸鱼终于装上了赛博义眼👀
DeepSeek V4-Flash-Vision-Exp已正式上线,
最新版DeepSeek Harness中已可直接调用该模型。
DeepSeek-V4-Flash-Vision-Exp 在 V4-Flash 的 MoE 语言主干上外挂视觉模块:图片由自研 DeepSeek-ViT 编码器转成视觉 token,经空间压缩与 CSA 机制极致压缩(单图最多 384 token,KV 缓存仅约 81 条),再与文本 token 对齐拼接,统一送入语言模型联合推理;同时借助边界框、坐标点等"视觉原语"做空间推理,从而在几乎不损失文本能力的前提下获得看图能力。
不过较头部原生多模态的大模型还有一定差距。