GPT-5.6 출시 🎉 모든 GPT 20% 할인 🎉 7월 한 달 내내 🔥자세히 보기
Qwen

Qwen Flash

Chat
bailian/qwen-flash
비교시작하기

Qwen Flash는 Alibaba Qwen 계열에서 가장 빠르고 가장 저렴한 모델로, Dashscope를 통해 제공되며 지연 시간에 민감한 작업을 위해 설계되었습니다. 초고속 추론을 제공하면서 도구 호출(function calling), 프롬프트 캐싱, 웹 검색을 지원하며, 가격은 입력 $0.022/M tokens, 출력 $0.22/M tokens입니다. 컨텍스트 윈도우: 1M tokens, 출력: 32K. OpenAI 및 Anthropic 프로토콜로 사용할 수 있습니다.

컨텍스트 윈도우
1M
최대 출력 토큰
32K
출시일
2025-07-28
기능
Function Calling프롬프트 캐싱웹 검색
제공업체
BaiLianAliyun
지원 프로토콜
OpenAIopenaiAnthropicanthropic

Providers

BaiLianAliyun
입력 토큰
$0.022/M
출력 토큰
$0.22/M
캐시 읽기
$0.0043/M
캐시 쓰기
$0.027/M
웹 검색
$0.01/R
Protocols
OpenAIopenai/v1/chat/completions/v1/responses
Anthropicanthropic

코드 예제

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.ai/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="bailian/qwen-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

자주 묻는 질문

Qwen Flash은(는) Ofox.ai에서 입력 $0.022/M/백만 토큰, 출력 $0.22/M/백만 토큰입니다. 종량제, 월정액 없음.