DeepSeek V4.1 Flash
Chatdeepseek/deepseek-v4.1-flashDeepSeek V4.1 Flash is DeepSeek's latest efficiency-optimized Mixture-of-Experts model with a 1M-token context window and up to 384K output tokens. It adds native multimodal vision understanding, supports thinking mode (on by default), tool calls, JSON output and prompt caching, and per DeepSeek surpasses V4 Pro on quality, cost and speed. Served upstream under the official model id deepseek-flash.
Ventana de Contexto
1M
Tokens de Salida Máximos
384K
Lanzamiento
2026-09-10
Capacidades
VisiónFunction CallingRazonamientoPrompt Caching
Proveedores Disponibles
DeepSeek
Protocolos Soportados
openaianthropic
Providers
DeepSeek
Tokens de Entrada
$0.3/M
Tokens de Salida
$1.2/M
Lectura de Caché
$0.006/M
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Ejemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="deepseek/deepseek-v4.1-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Modelos Relacionados
Preguntas Frecuentes
DeepSeek V4.1 Flash en Ofox.ai cuesta $0.3/M por millón de tokens de entrada y $1.2/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.
DeepSeek V4.1 Flash soporta una ventana de contexto de 1M tokens con salida máxima de 384K tokens, permitiéndote procesar documentos extensos y mantener conversaciones largas.
Simplemente configura tu base URL a https://api.ofox.ai/v1 y usa tu API key de Ofox. La API es compatible con OpenAI — solo cambia la base URL y la API key en tu código existente.
DeepSeek V4.1 Flash soporta las siguientes capacidades: Visión, Function Calling, Razonamiento, Prompt Caching. Accede a todas las funciones a través de la API unificada de Ofox.ai.