DeepSeek-V4-Flash-Vision-Exp вече е достъпен като експериментален мултимодален модел, тоест модел, който приема текст и изображения.

Изображенията могат да се изпращат в base64, чрез външен URL или през Files API. При таксуването всяко изображение се отчита като до 384 токена по цената на V4-Flash.

Проверка на твърденията:

  • DeepSeek-V4-Flash-Vision-Exp е достъпен в API на DeepSeek. (потвърдено от самата публикация: доказателство; «DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform!»)
  • Моделът поддържа комбиниран вход от текст и изображения. (потвърдено от самата публикация: доказателство; «Supports mixed text + image input; images can be provided via base64, external URLs, or the Files API»)
  • Изображенията се таксуват като до 384 токена всяко по цената на V4-Flash. (потвърдено от самата публикация: доказателство; «Images are tokenized for billing: up to 384 tokens each, at V4-Flash pricing»)
  • DeepSeek-V4-Flash-Vision-Exp е експериментален мултимодален модел. (потвърдено от самата публикация: доказателство; «This experimental multimodal model matches DeepSeek-V4-Flash on text capabilities—including agents, reasoning, and world knowledge.»)
  • Изображенията могат да се изпращат в base64, чрез външен URL или през Files API. (потвърдено от самата публикация: доказателство; «Supports mixed text + image input; images can be provided via base64, external URLs, or the Files API»)

Публикации:

Първоизточници:

оценка 26,6 от 100 · вид: изследване · актуализация 4