DeepSeek把V4视觉模型拆开给你了:168GB权重、MIT协议,Agent为的是自己看
2026-09-09 10:40 DeepSeek

DeepSeek-V4-Flash-Vision-Exp 已在 Hugging Face 以 MIT 协议放出权重,仓库总体积168GB,提供权重、分词器与最简 PyTorch 推理实现,视觉编码器、Aligner、DFlash Attention、MoE 与 Hyper-Connections 等核心模块一并开放,社区已跟进推出适配 llama.cpp、LM Studio、Ollama 的七个量化版本。这是 V4 系列首个原生视觉模型,但它的定位不是”看图说话”——官方强调其多模态 Agent 能力,让智能体直接读取网页截图、软件界面与图表后调用工具执行任务。

88.jpg