使用 Responses API
支持的模型
Responses API 目前仅支持
为了满足大家对 Codex 的需求,我们的 API 新增了对 Responses API 格式的支持,其 base_url 为 https://api.deepseek.com/
通过简单的配置,即可在 Codex 中使用 DeepSeek 模型。
将 DeepSeek 模型接入 Codex
请参考接入 Codex
通过 Responses API 调用 DeepSeek 模型
流式输出
设置
完整事件列表:
兼容性明细
本小节罗列了 DeepSeek API 对 Responses API 的兼容性细节。Responses API 完整格式定义,请参考 OpenAI 官方 API 手册。
顶层请求参数
不支持的参数会被静默忽略、不会报错,因此现有的 Responses API 客户端无需修改即可接入。
输入 Items
Tools
响应字段
响应对象与 OpenAI Responses API 的
Token 用量在
●
●
via DeepSeek 新闻
支持的模型
Responses API 目前仅支持
deepseek-v4-flash 模型,暂不支持 deepseek-v4-pro 模型。我们将于 2026 年 8 月初增加对 deepseek-v4-pro 模型的支持。为了满足大家对 Codex 的需求,我们的 API 新增了对 Responses API 格式的支持,其 base_url 为 https://api.deepseek.com/
通过简单的配置,即可在 Codex 中使用 DeepSeek 模型。
将 DeepSeek 模型接入 Codex
请参考接入 Codex
通过 Responses API 调用 DeepSeek 模型
# Please install OpenAI SDK first: `pip3 install openai`
from openai import OpenAI
client = OpenAI(api_key="<your DeepSeek API Key>", base_url="https://api.deepseek.com")
response = client.responses.create(
model="deepseek-v4-flash",
instructions="You are a helpful assistant.",
input="Hi, how are you?",
)
print(response.output_text)
流式输出
设置
stream: true,响应将以语义化的流式 SSE 事件序列返回。每个事件带有表示事件类型的 event 字段和递增的 sequence_number。流以 response.completed / response.incomplete / response.failed 事件结束,没有 data: [DONE] 消息。stream = client.responses.create(
model="deepseek-v4-flash",
instructions="You are a helpful assistant.",
input="Hi, how are you?",
stream=True,
)
for event in stream:
if event.type == "response.output_text.delta":
print(event.delta, end="")
完整事件列表:
兼容性明细
本小节罗列了 DeepSeek API 对 Responses API 的兼容性细节。Responses API 完整格式定义,请参考 OpenAI 官方 API 手册。
顶层请求参数
不支持的参数会被静默忽略、不会报错,因此现有的 Responses API 客户端无需修改即可接入。
输入 Items
Tools
响应字段
响应对象与 OpenAI Responses API 的
response 结构兼容。依赖未支持能力的字段恒为固定值(如 store: false、previous_response_id: null、parallel_tool_calls: true)。Token 用量在
usage 中返回:●
input_tokens:输入 token 数,其中 input_tokens_details.cached_tokens 为命中上下文缓存的 token 数●
output_tokens:输出 token 数,其中 output_tokens_details.reasoning_tokens 为思维链 token 数via DeepSeek 新闻