Llega GPT-5.6 🎉 20% de descuento en todo GPT 🎉 Todo julio 🔥Más info
Qwen

Qwen Flash

Chat
bailian/qwen-flash
CompararEmpezar

Qwen Flash es el modelo más rápido y económico de la familia Qwen de Alibaba, servido a través de Dashscope y diseñado para tareas sensibles a la latencia. Ofrece inferencia ultrarrápida y admite uso de herramientas (function calling), caché de prompts y búsqueda web, con un precio de $0.022/M tokens de entrada y $0.22/M de salida. Ventana de contexto: 1M tokens, salida: 32K. Disponible mediante los protocolos OpenAI y Anthropic.

Ventana de Contexto
1M
Tokens de Salida Máximos
32K
Lanzamiento
2025-07-28
Capacidades
Function CallingPrompt CachingBúsqueda Web
Proveedores Disponibles
BaiLianAliyun
Protocolos Soportados
OpenAIopenaiAnthropicanthropic

Providers

BaiLianAliyun
Tokens de Entrada
$0.022/M
Tokens de Salida
$0.22/M
Lectura de Caché
$0.0043/M
Escritura de Caché
$0.027/M
Búsqueda Web
$0.01/R
Protocols
OpenAIopenai/v1/chat/completions/v1/responses
Anthropicanthropic

Ejemplos de Código

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.ai/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="bailian/qwen-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Preguntas Frecuentes

Qwen Flash en Ofox.ai cuesta $0.022/M por millón de tokens de entrada y $0.22/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.