DeepSeek V4.1 Flash API 怎么接?Python 和 curl 调用教程

用 deepseek-flash 调用 DeepSeek V4.1 Flash,核对 API 地址和模型 ID,运行 Python、curl 示例,并区分旧型号、账单与请求报错。

鼠尾草绿色背景,浅色纸面上的折纸飞机黑色墨线图,搭配几何点缀和 DeepSeek V4.1 Flash 标题。

直连 DeepSeek V4.1 Flash API 时,使用 model="deepseek-flash",Base URL 为文档中的 https://api.deepseek.com 产品展示名称与请求 ID 不是同一个字符串。第三方网关可能另有模型 ID 和凭据要求。

示例依据官方快速入门及 2026 年 9 月 10 日更新日志编写。这些是经过文档核对的配置示例,没有做付费端到端实测。实际执行生成请求可能消耗余额。

先确认账户和模型

从准备实际调用的供应商获取凭据。DeepSeek 直连 Key 配 DeepSeek 端点,Ofox Key 配 Ofox 文档指定的路由。不要把一家供应商的端点与另一家的 Key 组合使用。

以下示例将凭据保存在本地环境变量 DEEPSEEK_API_KEY 中,不要提交到代码仓库或打印到日志。deepseek-flash 发布说明解释了为什么底层模型变化后,旧 V4 Flash 名称仍可能被接受。

Python:先获得一次文本回复

在项目环境中运行 python -m pip install openai,安装官方 OpenAI Python 包,再通过其兼容客户端调用:

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["DEEPSEEK_API_KEY"],
    base_url="https://api.deepseek.com",
)
response = client.chat.completions.create(
    model="deepseek-flash",
    messages=[{"role": "user", "content": "Reply with one short greeting."}],
    max_tokens=128,
    extra_body={"thinking": {"type": "disabled"}},
)
print(response.choices[0].message.content)
print(response.usage)

这里刻意不启用思考和工具,让第一次诊断请求保持简单。它不能展示推理 Agent 的成本或行为。基础请求成功后,再逐项加入所需能力,并核对对应文档参数。

curl:核对实际 HTTP 请求

curl --fail-with-body https://api.deepseek.com/chat/completions \
  -H "Authorization: Bearer $DEEPSEEK_API_KEY" \
  -H "Content-Type: application/json" \
  --data '{"model":"deepseek-flash","messages":[{"role":"user","content":"Reply with one short greeting."}],"max_tokens":128,"thinking":{"type":"disabled"}}'

这份 JSON 表达的是同一个简单文本任务。命令失败时,保留脱敏后的错误正文;只看状态码,可能漏掉请求路由或账户错误。不要把包含认证头的详细请求记录直接贴进支持工单。

使用 JavaScript 时,对应的 OpenAI SDK 配置项是 baseURL,请求中的模型和 JSON 字段相同。应按已安装 SDK 的接口文档填写,不要机械照搬 Python 参数名称。

客户端与协议要匹配

客户端或操作需要验证的内容
Chat Completions/chat/completionsmessages 请求
Codex / ResponsesResponses 配置与模型目录元数据
Claude Code / Anthropic 格式Anthropic 兼容基础路径与模型映射
图片理解使用受支持的图片内容块,而非仅在普通字符串里写图片文件名

完整客户端要求见 Codex 配置教程Claude Code 配置教程。一次文本回复成功,不能验证工具循环、图片输入或流式解析器。

找不到模型或请求失败,怎么查?

先查请求发往哪里,再查准确 ID。旧客户端目录可能尚未收录 deepseek-flash;网关也可能使用另一个名称。不要把 expires-on-0910 测试配置当成正式模型约定。记录真实响应,不要假定各平台都会对未知模型返回相同错误码。

DeepSeek 的错误码文档区分了 401 认证失败、402 余额不足、400 请求格式、422 参数和 429 速率限制。确认是余额问题后,充值才与修复有关;充值不能修正错误请求正文或不支持的型号。对临时失败有计划地控制请求频率和重试,不要无限循环。

为批量调用充值前,先用价格与预算算例估算。选择 Ofox 时,先查模型目录认证指南,明确目标路由与计费条件后再注册。本文直连示例不代表网关配置完全相同。

决定在哪个平台充值前,先按API 购买检查清单核对模型、协议与计费条件。

常见问题

V4.1 Flash 的官方 API 模型 ID 是什么?
直连 DeepSeek API 时使用 deepseek-flash。网关可能使用不同 ID,应查看其自身目录。
DeepSeek 的 Key 能配 Ofox 端点吗?
使用实际调用平台签发的凭据,不要把一家供应商的 Key 与另一家的端点混用。
文本调用成功,就代表 Codex 或 Claude Code 配好了吗?
不代表。这些客户端需要各自的协议和模型配置,还要验证实际需要的工具工作流。