Chegou o GPT-5.6 🎉 20% de desconto em todos os GPT 🎉 O mês todo 🔥Saiba mais
Qwen

Qwen3 Coder Flash

Chat
bailian/qwen3-coder-flash
CompararComeçar

Qwen3-Coder-Flash é o modelo de programação custo-eficiente da Alibaba, construído sobre a arquitetura Qwen3. Herda as capacidades de agentic coding do Qwen3-Coder-Plus, suporta interação multi-turn com ferramentas e é otimizado para compreensão de código em nível de repositório com maior estabilidade em tool-calls. Context window: 1M tokens, output: 64K. Disponível via protocolos OpenAI e Anthropic.

Janela de Contexto
1M
Tokens Máx de Saída
64K
Lançamento
2025-08-05
Capacidades
Function CallingRaciocínioPrompt Caching
Provedores Disponíveis
BaiLianAliyun
Protocolos Suportados
OpenAIopenaiAnthropicanthropic

Providers

BaiLianAliyun
Tokens de Entrada
$0.5/M
Tokens de Saída
$2.5/M
Leitura de Cache
$0.06/M
Escrita de Cache
$0.27/M
Protocols
OpenAIopenai/v1/chat/completions/v1/responses
Anthropicanthropic

Exemplos de Código

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.ai/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="bailian/qwen3-coder-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Perguntas Frequentes

Qwen3 Coder Flash na Ofox.ai custa $0.5/M por milhão de tokens de entrada e $2.5/M por milhão de tokens de saída. Pague por uso, sem mensalidade.