DeepSeek-v4 视觉模型 API 指南
DeepSeek-v4-flash-vision-exp

DeepSeek 推出了 deepseek-v4-flash-vision-exp 模型,支持通过 OpenAI 兼容接口、Anthropic 接口以及 Responses API 处理图像。开发者可以灵活选择三种方式上传图片:Base64 内嵌、外部 URL 或 Files API 文件引用。系统自动根据图像尺寸调整 Token 消耗,单图上限为 384 个 Token,并支持 JPEG、PNG、GIF 和 WebP 格式。文档详细说明了不同场景下的最佳实践,包括大文件处理、多图请求限制以及 detail 参数的使用策略,帮助开发者高效集成视觉分析能力。
图像会根据其尺寸转换为 Token,这些 Token 将与你的文本 Token 一起计费。