图片
分类
输入
目前,deepseek-v4-flash-vision-exp支持混合文本和图片输入,图片可以通过Base64、外部URL或FilesAPI方式提供。
文章
该模型在保持DeepSeek-V4-Flash文本能力的基础上,新增视觉理解能力,可以处理图片输入,并进一步提升多模态Agent任务表现。
文章
理解能力接入
开发者可以通过ChatCompletions、Messages以及ResponsesAPI调用该模型,使图片理解能力接入不同类型的应用。
文章
效果
当图片需要在多个请求、多轮对话或者Agent任务中重复使用时,不仅增加网络传输成本,也会受到请求大小限制影响。
文章