DeepSeek(@deepseek_ai)

Multimodal API support 🔌 🔹 Set model='deepseek-v4-flash-vision-exp' 🔹 Images are tokenized for b...

8.5内容质量

TL;DR · AI 摘要

DeepSeek推出支持多模态的API,允许通过图像和文本混合输入进行交互,适用于需要视觉和文本处理的应用场景。

核心要点

  • DeepSeek的'deepseek-v4-flash-vision-exp'模型支持图像和文本混合输入,每个图像最多384个token计费。
  • 图像可通过base64、URL或Files API上传,适用于多种集成场景。
  • 该API支持Chat Completions、Messages & Responses,适合构建多模态交互应用。

结构提纲

按章节快速跳转。

  1. DeepSeek宣布推出支持图像和文本混合输入的API接口。

  2. 需设置model='deepseek-v4-flash-vision-exp'启用视觉功能。

  3. 图像按384 tokens/张计费,采用V4-Flash定价策略。

  4. 支持base64编码、外部URL和Files API三种图像传输方式。

  5. 兼容Chat Completions、Messages & Responses等主流API接口规范。

思维导图

用一张图看清主题之间的关系。

查看大纲文本(无障碍 / 无 JS 友好)
  • 多模态API支持
    • 模型参数
      • deepseek-v4-flash-vision-exp
      • V4-Flash定价
    • 输入方式
      • base64编码
      • 外部URL
      • Files API
    • 功能特性
      • Chat Completions
      • Messages & Responses
      • 384 tokens/图像计费

金句 / Highlights

值得收藏与分享的关键句。

#API#多模态#DeepSeek#图像处理
打开原文

DeepSeek on X: "Multimodal API support 🔌 🔹 Set model='deepseek-v4-flash-vision-exp' 🔹 Images are tokenized for billing: up to 384 tokens each, at V4-Flash pricing 🔹 Supports Chat Completions, Messages & Responses 🔹 Supports mixed text + image input; images can be provided via base64, external… / X

DeepSeek

@deepseek_ai

Multimodal API support 🔌 🔹 Set model='deepseek-v4-flash-vision-exp' 🔹 Images are tokenized for billing: up to 384 tokens each, at V4-Flash pricing 🔹 Supports Chat Completions, Messages & Responses 🔹 Supports mixed text + image input; images can be provided via base64, external URLs, or the Files API. Docs:

api-docs.deepseek.com/guides/vision

3/n

Vision | DeepSeek API Docs

From api-docs.deepseek.com

9:17 AM · Aug 21, 2026

102.7K

Views

7

17

537

51