快讯
DeepSeek开源V4-Flash-Vision-Exp,首次为V4系列加入多模态能力
DeepSeek在Hugging Face发布V4-Flash-Vision-Exp模型权重与推理代码,这是V4家族首个实验性多模态模型,兼顾视觉理解与文本Agent任务。
DeepSeek已在Hugging Face发布DeepSeek-V4-Flash-Vision-Exp模型权重、分词器和最小化推理实现。官方将其称为V4家族首个实验性多模态模型:它在V4-Flash架构上加入视觉模块,并继续训练以获得视觉理解能力。
模型卡称,新模型相较DeepSeek-V4-Flash-0731显著提升多模态Agent能力,同时保持相近的纯文本Agent表现。仓库采用MIT许可证,包含视觉编码器、对齐器、DFlash注意力、MoE、Hyper-Connections和DSpark前向路径的参考实现。
参考:DeepSeek模型卡