DeepSeek(@deepseek_ai)
Multimodal API support 🔌 🔹 Set model='deepseek-v4-flash-vision-exp' 🔹 Images are tokenized for b...
8.5内容质量
TL;DR · AI 摘要
DeepSeek推出支持多模态的API,允许通过图像和文本混合输入进行交互,适用于需要视觉和文本处理的应用场景。
核心要点
- DeepSeek的'deepseek-v4-flash-vision-exp'模型支持图像和文本混合输入,每个图像最多384个token计费。
- 图像可通过base64、URL或Files API上传,适用于多种集成场景。
- 该API支持Chat Completions、Messages & Responses,适合构建多模态交互应用。
结构提纲
按章节快速跳转。
DeepSeek宣布推出支持图像和文本混合输入的API接口。
需设置model='deepseek-v4-flash-vision-exp'启用视觉功能。
- ›计费机制
图像按384 tokens/张计费,采用V4-Flash定价策略。
- ·输入方式
支持base64编码、外部URL和Files API三种图像传输方式。
- ›功能支持
兼容Chat Completions、Messages & Responses等主流API接口规范。
思维导图
用一张图看清主题之间的关系。
查看大纲文本(无障碍 / 无 JS 友好)
- 多模态API支持
- 模型参数
- deepseek-v4-flash-vision-exp
- V4-Flash定价
- 输入方式
- base64编码
- 外部URL
- Files API
- 功能特性
- Chat Completions
- Messages & Responses
- 384 tokens/图像计费
金句 / Highlights
值得收藏与分享的关键句。
图像被分词计费,每个图像最多384 tokens,按V4-Flash定价。
支持混合文本和图像输入,图像可通过base64、URL或Files API提供。
文档链接指向DeepSeek的API指南,便于开发者查阅具体实现细节。
#API#多模态#DeepSeek#图像处理
打开原文DeepSeek on X: "Multimodal API support 🔌 🔹 Set model='deepseek-v4-flash-vision-exp' 🔹 Images are tokenized for billing: up to 384 tokens each, at V4-Flash pricing 🔹 Supports Chat Completions, Messages & Responses 🔹 Supports mixed text + image input; images can be provided via base64, external… / X
DeepSeek
@deepseek_ai
Multimodal API support 🔌 🔹 Set model='deepseek-v4-flash-vision-exp' 🔹 Images are tokenized for billing: up to 384 tokens each, at V4-Flash pricing 🔹 Supports Chat Completions, Messages & Responses 🔹 Supports mixed text + image input; images can be provided via base64, external URLs, or the Files API. Docs:
api-docs.deepseek.com/guides/vision
3/n
Vision | DeepSeek API Docs
From api-docs.deepseek.com
9:17 AM · Aug 21, 2026
102.7K
Views
7
17
537
51