DeepSeek-v4-flash-vision-exp: el modelo de DeepSeek que analiza imágenes

DeepSeek ha publicado la documentación de su nuevo modelo de visión, deepseek-v4-flash-vision-exp, que acepta imágenes junto a texto para describir fotos, leer texto de capturas y analizar gráficos. El modelo soporta formatos JPEG, PNG, GIF y WebP, y admite hasta 600 imágenes por petición, con un límite de 48 MiB para el cuerpo de la solicitud. Las imágenes se pueden enviar en base64, mediante URL externa o a través de la Files API. El modelo también es compatible con la API de Anthropic y la Responses API.
El formato se detecta a partir del contenido real del archivo, no del nombre del archivo ni del tipo MIME declarado.