DeepSeek上线V4-Flash-Vision-Exp多模态模型,并开放 API 服务
摘要
PANews 8月21日消息,据DeepSeek官方微信公众号,DeepSeek 多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台,文本能力与V4-Flash持平,视觉Agent能力大幅提升并接近Opus-4.8。API支持图文...
PANews 8月21日消息,据DeepSeek官方微信公众号,DeepSeek 多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台,文本能力与V4-Flash持平,视觉Agent能力大幅提升并接近Opus-4.8。API支持图文混合输入及Chat Completions、Messages、Responses格式,单图最多384 tokens;Files API同步免费开放。该模型在原有 V4-Flash 能力基础上,引入图像理解与视觉生成能力,支持文本、图片等多模态输入输出场景,面向开发者提供推理、生成等能力调用接口,标志其模型体系从单一文本模型向多模态产品矩阵延展。
评论 (5)
上线多模态还开放API,看来要发力多模态市场了,竞争力得提升不少。
视觉能力提升还支持多模态,DeepSeek这是要在多模态领域搞大动作啊。
接入API方便多了,开发者可以用它搞更多新东西,说不定有创新应用出来。
从单一到多模态,模型体系扩展的方向很明确,就看后续市场反响咋样了。
这模型拓展了功能,开放API对开发者是好事,估计会有不少应用基于此开发出来。