GPT-5.6 출시 🎉 모든 GPT 20% 할인 🎉 7월 한 달 내내 🔥자세히 보기
Qwen

Qwen: Qwen3.5 Flash

Chat
bailian/qwen3.5-flash
비교시작하기

Qwen3.5-Flash는 Alibaba Qwen3.5 시리즈의 속도 최적화 비전-언어 모델로, 하이브리드 선형 어텐션과 스파스 MoE 설계를 통해 높은 추론 처리량을 구현합니다. 텍스트 및 멀티모달 작업 모두에서 Qwen3 Flash 대비 유의미한 성능 향상을 보입니다. Context: 1M tokens, 출력: 64K. OpenAI 및 Anthropic 프로토콜로 이용 가능합니다.

컨텍스트 윈도우
1M
최대 출력 토큰
64K
출시일
2026-02-23
기능
비전Function Calling추론프롬프트 캐싱영상 입력
제공업체
BaiLianAliyun
지원 프로토콜
OpenAIopenaiAnthropicanthropic

Providers

BaiLianAliyun
입력 토큰
$0.1/M
출력 토큰
$0.4/M
캐시 읽기
$0.01/M
캐시 쓰기
$0.125/M
웹 검색
$0.01/R
Protocols
OpenAIopenai/v1/chat/completions/v1/responses
Anthropicanthropic

코드 예제

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.ai/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="bailian/qwen3.5-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

벤치마크

LMArena평가 항목: qwen3.5-flash

Qwen: Qwen3.5 Flash은(는) LMArena 텍스트 리더보드(스타일 컨트롤) 종합 카테고리에서 1398점을 기록했으며, 53,387건의 인간 선호 투표를 기반으로 374개 모델 중 129위입니다(업데이트: 2026-07-12).

LMArena의 qwen3.5-flash 벤치마크 점수
카테고리Arena 점수95% 신뢰구간순위투표 수
종합139813941402374개 중 129위53,387
고난도 프롬프트141514111420374개 중 134위34,166
코딩143714311443369개 중 134위15,155
수학140413931416362개 중 117위2,952
창작133913321347372개 중 155위8,270
지시 이행138213761388374개 중 137위16,970
중국어145114381463344개 중 101위2,528

출처: LMArena · CC BY 4.0 · 업데이트 2026-07-12 · 평가 방법 · 순위는 LMArena 텍스트 리더보드(스타일 컨트롤)의 각 카테고리 내 비교이며, 점수는 제3자의 인간 선호 평가로 OFOX 공식 평가가 아닙니다.

자주 묻는 질문

Qwen: Qwen3.5 Flash은(는) Ofox.ai에서 입력 $0.1/M/백만 토큰, 출력 $0.4/M/백만 토큰입니다. 종량제, 월정액 없음.