DeepSeek V4.1 Flash
Chatdeepseek/deepseek-v4.1-flashDeepSeek V4.1 Flash is DeepSeek's latest efficiency-optimized Mixture-of-Experts model with a 1M-token context window and up to 384K output tokens. It adds native multimodal vision understanding, supports thinking mode (on by default), tool calls, JSON output and prompt caching, and per DeepSeek surpasses V4 Pro on quality, cost and speed. Served upstream under the official model id deepseek-flash.
Fenêtre de contexte
1M
Tokens de sortie max
384K
Publié
2026-09-10
Capacités
VisionFunction CallingRaisonnementPrompt Caching
Fournisseurs disponibles
DeepSeek
Protocoles supportés
openaianthropic
Providers
DeepSeek
Tokens d'entrée
$0.3/M
Tokens de sortie
$1.2/M
Lecture cache
$0.006/M
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Exemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="deepseek/deepseek-v4.1-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Modèles associés
Questions fréquentes
DeepSeek V4.1 Flash sur Ofox.ai coûte $0.3/M par million de tokens d'entrée et $1.2/M par million de tokens de sortie. Paiement à l'usage, sans frais mensuels.
DeepSeek V4.1 Flash supporte une fenêtre de contexte de 1M tokens avec un maximum de 384K tokens en sortie, permettant de traiter de longs documents et de maintenir des conversations prolongées.
Configurez simplement votre URL de base sur https://api.ofox.ai/v1 et utilisez votre clé API Ofox. L'API est compatible OpenAI — changez simplement l'URL de base et la clé API dans votre code existant.
DeepSeek V4.1 Flash supporte les capacités suivantes : Vision, Function Calling, Raisonnement, Prompt Caching. Accédez à toutes les fonctionnalités via l'API unifiée Ofox.ai.