DeepSeek добавила DeepSeek-V4-Flash-Vision-Exp в свою API-платформу. Это экспериментальная мультимодальная модель, которая работает с текстом и изображениями.

В одном запросе можно передавать текст и изображения в base64, по внешней ссылке или через Files API. При расчёте стоимости изображение занимает до 384 токенов по тарифу V4-Flash.

Модель поддерживает интерфейсы Chat Completions, Messages и Responses.

Проверка утверждений:

  • DeepSeek-V4-Flash-Vision-Exp доступна на платформе API DeepSeek. (подтверждено самой публикацией: доказательство; «DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform!»)
  • Это экспериментальная мультимодальная модель DeepSeek. (подтверждено самой публикацией: доказательство; «This experimental multimodal model matches DeepSeek-V4-Flash on text capabilities—including agents, reasoning, and world knowledge.»)
  • Модель принимает смешанный текстовый и визуальный ввод, а изображения можно передавать в base64, по внешним URL или через Files API. (подтверждено самой публикацией: доказательство; «Supports mixed text + image input; images can be provided via base64, external URLs, or the Files API»)
  • Для биллинга каждое изображение токенизируется максимум в 384 токена по тарифу V4-Flash. (подтверждено самой публикацией: доказательство; «Images are tokenized for billing: up to 384 tokens each, at V4-Flash pricing»)
  • Модель поддерживает Chat Completions, Messages и Responses. (подтверждено самой публикацией: доказательство; «Supports Chat Completions, Messages & Responses»)

Публикации:

Первоисточники:

оценка 20,6 из 100 · тип: исследование · обновление 5