Skip to main content
POST
Messages with vision: DeepSeek V4 Flash Vision (Anthropic format)
这个端点的令牌必须是 ClaudeCode 分组,这是硬要求。default 分组会撞上两个叠加问题:
  1. 不显式传 top_p 一律返回 400 Invalid top_p value
  2. 就算补上 top_p,把第一轮返回的 thinking 块原样回传到第二轮会报 unknown variant 'thinking', expected one of 'text', 'image_url', 'file' —— 而 Claude Code、Anthropic SDK 这类标准客户端一定会原样回传,所以多轮必断
换成 ClaudeCode 分组,两个问题都不存在。OpenAI 格式请改用 Chat 在线调试
右侧 Playground 可直接调试:在 x-api-keysk-your-apiyi-keyClaudeCode 分组的令牌, 不带 Bearer 前缀),anthropic-version 保持 2023-06-01。 默认示例用的是一张公网图片、并已关闭深度思考,点击发送即可看到响应。

参数说明速查

两种传图方式

source.type = "base64"

注意 data 不含 data:image/jpeg;base64, 前缀(这一点和 OpenAI 格式不同)。

source.type = "url"

source.type = "url" 只有 ClaudeCode 分组支持default 分组会报 You have uploaded an unsupported imagesource.type = "file" 需要 Files API,本平台不提供。

响应的 content 是块数组

ClaudeCode 分组返回的 thinking 块带 signature 字段,流式下也有 signature_delta

多轮与工具闭环

把上一轮 assistant 的整个 contentthinking 块,不要剥)原样放回 messages, 再追加 tool_result 即可:
实测第二轮正常返回。这一步正是 default 分组会 400 的地方,也是 Claude Code 等客户端 的必经路径 —— 所以分组不能选错。

缓存字段的口径

自动前缀缓存生效,映射到 Anthropic 标准字段: 含图请求第 3 次调用才开始命中(纯文本第 2 次)。把固定的长指令放在图片前面才能进缓存。

常见报错

授权

x-api-key
string
header
必填

API易令牌,直接填 sk- 开头的 Key。分组必须为 ClaudeCode

请求头

anthropic-version
string
默认值:2023-06-01
必填

Anthropic API 版本号,固定 2023-06-01

请求体

application/json
model
enum<string>
默认值:deepseek-v4-flash-vision-exp
必填

模型 ID,固定 deepseek-v4-flash-vision-exp

可用选项:
deepseek-v4-flash-vision-exp
max_tokens
integer
默认值:800
必填

最大输出 tokens(Anthropic 格式下必填),硬上限 393,216。开思考建议 2000 以上

必填范围: x <= 393216
messages
object[]
必填

消息数组。content 可以是字符串,也可以是内容块数组(图文混合)

system
string

系统提示词

thinking
object

深度思考开关。传 {"type": "disabled"} 关闭后 content 只剩 text 块,本端点两个分组都生效

stream
boolean
默认值:false

是否流式输出(SSE)。事件为 Anthropic 标准的 message_start / content_block_delta / message_stop 等

temperature
number

采样温度

top_p
number

核采样阈值。ClaudeCode 分组下可省略;default 分组下不传必返回 400

top_k
integer

候选截断

stop_sequences
string[]

停止序列

tools
object[]

工具列表,Anthropic 标准 input_schema 格式。实测含流式增量拼装与完整两轮闭环

响应

生成成功

id
string
type
string
role
string
model
string
content
object[]

内容块数组。开启思考时为 [thinking, text],关闭后只剩 [text];调用工具时为 [thinking, tool_use]

stop_reason
string
usage
object

用量。注意与 OpenAI 格式口径不同:命中缓存后 input_tokens 只剩未命中部分,不能与 prompt_tokens 直接对账