DeepSeek-V4-Flash-Vision-Exp тепер доступна як експериментальна мультимодальна модель, тобто модель, що приймає текст і зображення.

Зображення можна передавати у base64, за зовнішнім посиланням або через Files API. Для розрахунку вартості кожне зображення враховується як до 384 токенів за тарифом V4-Flash.

Перевірка тверджень:

  • DeepSeek-V4-Flash-Vision-Exp доступна в API DeepSeek. (підтверджено самою публікацією: доказ; «DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform!»)
  • Модель підтримує спільне введення тексту та зображень. (підтверджено самою публікацією: доказ; «Supports mixed text + image input; images can be provided via base64, external URLs, or the Files API»)
  • Зображення тарифікуються як до 384 токенів кожне за ціною V4-Flash. (підтверджено самою публікацією: доказ; «Images are tokenized for billing: up to 384 tokens each, at V4-Flash pricing»)
  • DeepSeek-V4-Flash-Vision-Exp — експериментальна мультимодальна модель. (підтверджено самою публікацією: доказ; «This experimental multimodal model matches DeepSeek-V4-Flash on text capabilities—including agents, reasoning, and world knowledge.»)
  • Зображення можна передавати у base64, за зовнішнім посиланням або через Files API. (підтверджено самою публікацією: доказ; «Supports mixed text + image input; images can be provided via base64, external URLs, or the Files API»)

Публікації:

Першоджерела:

оцінка 26,6 зі 100 · тип: дослідження · оновлення 4